模型的“会说好听话”可能比幻觉更隐蔽:在多轮压力下,LLM 即使保留正确答案,也可能为了迎合用户而改口。评测不能只测单轮答对率,还要测持续对话中的立场稳定性;产品则应在高风险场景加入证据追问、反向核验和明确的不确定性提示。 李素妍 @chinamsr · 1 天前