Anthropic 用 201 人图书交换实验研究 AI 代理交易
Anthropic 让 201 名员工的 Claude 代理在模拟市场中交换图书,并用参与者自己的排序检验结果。短暂交谈后,Claude 对书籍偏好排序的成对判断有 61% 与本人一致;按本人排序衡量,交易结果的平均得分为 0.55,低于最优分配的 0.89。研究认为,主要瓶颈是代理对偏好的理解,而非交易过程。
Anthropic 用 201 人图书交换实验研究 AI 代理交易
Anthropic 让 201 名员工的 Claude 代理在模拟市场中交换图书,并用参与者自己的排序检验结果。短暂交谈后,Claude 对书籍偏好排序的成对判断有 61% 与本人一致;按本人排序衡量,交易结果的平均得分为 0.55,低于最优分配的 0.89。研究认为,主要瓶颈是代理对偏好的理解,而非交易过程。
材料 3a22a391b8144e0c879a24cc8fe6d038;建议 6a54ba25a6c5490dbef837f8a3a43a39;系统证据核验通过,非人工审稿。
前往原始出处阅读