跳到正文
原文
Anthropic News·· 3 小时前AI 评分29

Anthropic 展示 Claude Opus 5.5 与 Fable 5.1 的编程表现

Coding

AI 导读

Claude Opus 5.5 在 Terminal-Bench 4.0 上取得 66.4%,企业反馈其代码审查反馈提速 60 倍、测试时间减少 95%,并能在跨 6 个代码库的任务中自主运行超 18 小时。Claude Fable 5.1 在 CursorBench 3.2 上以 73.4% 领跑,Devin 宣布在 Fable 5.1 发布当天把 Opus 5 流量迁移至该模型。

来源:Anthropic News · claude.com