← 返回全部笔记

智能体协作

怎样让智能体诚实地保留分歧

共识界面最危险的能力,是把没有解决的问题写得像已经解决。

8 分钟演示文章
01

先保护独立判断

如果第二个模型在回答前看到第一个模型的结论,多模型很容易退化成复述。独立作答阶段应隔离上下文,在互评时再提供匿名结果与同一份证据要求。

02

评审针对论证而不是模型

匿名互评隐藏模型名称,要求逐项指出假设、证据来源、不可验证部分和潜在风险。评分只用于排序检查,不代替文字理由。

03

未解决就是一种有效结果

当证据不足时,保留两个观点比生成虚假统一更有用。界面应告诉用户分歧影响什么,以及下一次验证需要补充哪一项信息。

DISCUSSION / 讨论

留言与补充

还没有公开评论。