新当事方Anthropic 发布 Claude Opus 5.5,多数任务达到 Claude Fable 5.1 水平且运行成本比 Opus 5 低 40%𝕏
Anthropic9 月 24 日Perplexity 将 Claude Opus 5.5 设为 Computer Pro/Max 默认编排器
Perplexity 将 Claude Opus 5.5 设为 Computer Pro/Max 默认编排器
Artificial Analysis 的 AA-Briefcase v1.1 上 Opus 5.5(max)以 1,822 Elo 居首,领先 Fable 5.1 共 143 分
疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话
事件
| 看什么 | 现在的情况 | 依据 |
|---|---|---|
| 事实 | Artificial Analysis 的 AA-Briefcase v1.1 上 Opus 5.5(max)以 1,822 Elo 居首,领先 Fable 5.1 共 143 分 | |
| 官方 | Aravind Srinivas |
Aravind Srinivas其依据是 Perplexity 自研 Wide-And-Deep-Research 评测:Opus 5.5 表现优于 Fable 5.1,成本仅为零头𝕏
Artificial Analysis实测GDPval-AA v2.1 上 Opus 5.5 以 1,846 Elo 领先,比 Claude 系前代高 111 分𝕏
Taelin实测他在自己全部提示词上测得 Opus 5.5 明显优于 Fable 5.1,认为官方「与 Fable 5.1 相当」的说法低估了它𝕏
Ethan Mollick实测他用 Claude Fable 5.1 生成《荒原》多路径注释指南并开源,展示编码之外的用法𝕏
产业解读
这不是投资建议。
昨天
新当事方Anthropic 发布 Claude Opus 5.5,多数任务达到 Claude Fable 5.1 水平且运行成本比 Opus 5 低 40%𝕏
Anthropic昨天
Anthropic 正式发布 Claude Opus 5.5,表现达 Fable 5.1 水准且运算成本更低𝕏
科技新报Elon Musk 称 Grok 4.7 作为小模型表现相当好,引用 Next.js 评测中 Grok 4.7 得 94%、比 Opus 5.5/GPT 6 Sol/Fable 5.1 便宜 2x-7x𝕏
Elon MuskTestingCatalog 转述 Anthropic 发布 Claude Opus 5.5,称其在 agentic coding 与 computer use 上为新 SOTA,多数任务达 Claude Fable 5.1 水平且运行成本𝕏
TestingCatalogAnthropic 发布 Claude Opus 5.5,多数任务达到 Claude Fable 5.1 水平且运行成本比 Opus 5 低 40%𝕏
Anthropic更早
科技新报转述 RoboHarm 实体 AI 安全测试:GPT-6 Astra、Claude Fable 5.1 接双臂机器人执行五项高风险指令,缺乏稳定防御机制𝕏
科技新报关注后可跟此人更新与他说过的话,需用手机号登录