最新五项实验涉及3132人发现,引入GPT-5.5等大语言模型显著削弱人类悬置判断能力,几乎丧失承认“我不知道”的意愿。在易引发幻觉的冷门问题上,无AI对照组放弃作答率为36%至44%,获取AI建议后骤降至3%至6%,显示人们过度依赖AI结论。