Skip to content
AI

为什么在最关键的时刻,我无法信任模型的置信度分数?

88

机会

现代语言模型经常在错误答案上输出高置信度词元,在正确答案上输出低置信度词元。这种声称概率与实际准确率之间的差距被称为校准误差,已在 2025 年一项涵盖熵、logit 和扰动方法的调查中针对前沿模型进行了记录。使用这些分数来决定何时推迟或弃权的生产代理直接继承了错误校准,因此它们要么以虚假的确定性产生幻觉,要么不必要地拒绝正确答案。目前没有任何开箱即用的原语能够提供校准后的、可操作的不确定性信号,且廉价到可以在推理时对流式响应中的每个输出词元运行。

为什么重要

校准是每一个代理决策背后的信任原语,没有它,所有下游安全阈值都建立在沙上。

我如何评估机会

机会评分是我的个人判断,而非量化指标:痛苦程度、发生频率,以及当前解决方案的匮乏程度。分数越高,意味着我认为越值得去构建。

严重性9/10

出现时造成的痛苦程度。

频率9/10

人们实际遇到它的频率。

空白空间7/10

当前针对它的优质工具有多匮乏。

更多值得解决的问题