FUTURE SECTORS
人工智能

Anthropic公布代理换书实验:理解用户偏好仍是关键限制

Anthropic于9月24日公布Project Swap研究。201名员工参与代理换书实验,模型根据简短对话推断的书籍成对排序与用户判断一致率为61%。

Anthropic 9月24日公布Project Swap研究,在六个办公室组织201名员工参与换书实验。参与者先与Claude交流阅读偏好,再由AI代理协商交换书籍。

研究团队另行收集参与者对十本书的排序,用来检验代理是否准确理解偏好。根据简短对话生成的书籍成对排序,与参与者判断的一致率为61%,随机猜测的基准为50%。

团队认为,本实验中结果与最优分配之间的差距,主要来自代理掌握的偏好信息不完整,而非协商能力不足。这是受控的小型换书研究,其结果不能直接视为AI代理在真实金融交易中的表现。

配图:AI生成示意图。 来源:Anthropic https://www.anthropic.com/research/project-swap

← 返回 未来产业