跳到正文
原文
The Decoder· Matthias Bastian·· 4 小时前

研究发现AI智能体团队耗费大量token但质量提升微弱

AI agent teams waste massive tokens for barely measurable quality gains, research finds

SI 导读

Vals AI在Vibe Code Bench上测试发现,GPT-6 Sol与Claude Opus 5.5的AI智能体团队相比单智能体成本高出1.8至5.1倍,但质量提升大多不显著。在最高推理设置下团队未带来实质优势,仅GPT-6 Sol中等推理时团队得分高7.3分。Anthropic与OpenAI研究者也证实多智能体主要提升速度而非质量。

SI 评分70

来源:The Decoder · the-decoder.com

© 2026 SI·Hot · Super Intelligence Hot · 超级智能热点 · 网站数据均来源于网络公开资料,版权归来源方所有