跳到正文
原文
The Decoder· Matthias Bastian·· 2 小时前精选AI 评分57

评测显示多 AI agent 团队 token 成本最高 5.1 倍,质量提升几乎可忽略

AI agent teams waste massive tokens for barely measurable quality gains, research finds

AI 导读

Vals AI 在 Vibe Code Bench 上测试 GPT-6 Sol 和 Claude Opus 5.5 的单 agent 与团队模式,发现团队成本是单 agent 的 1.8–5.1 倍,四组对比中仅 GPT-6 Sol 在中等推理档位下出现 7.3 分的统计显著提升,其余几乎无优势。

推荐理由

给出了 Vibe Code Bench 等基准上多 agent 团队相对单 agent 的成本与质量对照,可以据此判断何时值得为多 agent 架构买单。

来源:The Decoder · the-decoder.com