一项涉及 3132 名参与者的五项实验研究表明,引入 AI 大语言模型(如 GPT-5.5、Claude4.6Sonnet 及 Gemini3.5Flash 等)正显著削弱人类悬置判断的能力,使人们几乎完全丧失承认”我不知道”的意愿。研究团队专门挑选了极易引发模型幻觉的精细冷门问题进行测试,结果显示,在无 AI 辅助的对照组中,参与者对 36% 至 44% 的问题选择放弃作答。更为矛盾的是,在 AI 辅助下,参与者的答题自信心从 29.6 分(满分 100 分)暴涨至 75.9 分,但实际答对率却从 27.5% 大幅跌至 9.2%,表明即便面对 Step3.5Flash 等模型给出的错误建议,人类依然倾向于盲目采纳并产生过度自信。

