9 月 24 日Claude Opus 5.5、GPT-6 Sol/Luna 与 MiMo-V2.6-Pro 同周把智能-成本 Pareto 前沿整体外推

话题 · 模型产品

先看结论

Claude Opus 5.5、GPT-6 Sol/Luna 与 MiMo-V2.6-Pro 同周把智能-成本 Pareto 前沿整体外推

写作榜实测给 Opus 5.5 打出 2631 Elo 登顶,被引用的评测者称分数高到一度怀疑是 bug

这些标记是什么意思

疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话

最新进展Artificial Analysis:MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna、GPT-6 Sol 发布后 Intelligence Index vs Cost per Task Pareto 前沿
当前状态未定稿 · 转述

事件

Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index,并降价 20% 且加大缓存命中折扣(GPT-

看什么现在的情况依据
事实写作榜实测给 Opus 5.5 打出 2631 Elo 登顶,被引用的评测者称分数高到一度怀疑是 bug
后果Cursor 已上线 Opus 5.5:每任务成本比 Opus 5 低 40%,代码任务可直接换档试
官方尚未表态

各方4 人

Artificial Analysis实测榜单方把四个新模型放进同一张 Intelligence Index 对每任务成本的图里比较,前沿由它们共同建立𝕏

Taelin分析他在找 Opus 5.5 的长上下文推理基准,想确定模型开始掉 IQ 之前能撑住的实际上下文长度𝕏

Teortaxes解读他认为 Anthropic 一直有能力修复旧问题却没做,只是这次没人在意到拦下 5.5𝕏

Nathan Labenz转述Prakash 称 GPT-6 Sol、Luna 与 Opus 5.5 同日发布,就是所谓压着前沿节奏走𝕏

产业解读

关键数字AA 口径 max 档 $5.98/任务、token 用量升约 80%;Box 实测 token 少 63%、成本低 42%,两套数方向相反
时间点AA 前沿图与写作榜实测均落在发布后约一天内(本周)
谁会受影响Cursor 等编程工具已接入换默认档;OpenAI 的 GPT-6 Sol/Luna 与小米 MiMo-V2.6-Pro 同周争前沿位置

这不是投资建议。

转折昨天 1

昨天

这件事今天 1 · 昨天 26

今天

Ian Cutress 转述 Arm Izanagi XPU 1 规格:TSMC N2 on N3、5.5x reticle、120mm x 125mm 封装、HBM4𝕏

Ian Cutress

昨天

Elvis Saravia 判断 Opus 5.5 更像 Opus 4.5,写作明显变好且 Claudese 味基本消失𝕏

Elvis Saravia

Simon Willison 撰文对比 Claude Opus 5.5、GPT-6 Sol 与 GPT-6 Luna,并附各模型家族不同推理级别的 pelican 对比图𝕏

Simon Willison

Artificial Analysis:Claude Opus 5.5 (max) 每 Intelligence Index task 成本 $5.98,与 Opus 5 (max) 的 $5.86 相近,但 token 用量增加约 80%𝕏

Artificial Analysis
同日另有 1 条同源
  • Artificial Analysis:Claude Opus 5.5 (max) 每 Intelligence Index task 成本 $5.98,与 Opus 5 (max) 的 $5.86 相近,但 token 用量上升约 80%𝕏

TestingCatalog:Claude 网页版与桌面版上线 Banked usage limit reset 按钮,供用户探索 Opus 5.5𝕏

TestingCatalog

Aaron Levie:Opus 5.5 降价叠加 GPT-6 Sol 与 Luna token 价格降 50%,AI 每任务成本下降速度前所未见𝕏

Aaron Levie

Teortaxes 判断 GPT-6 Sol 与 Luna 更便宜更好,疑似原生训练为 Astra 的从属模型,可能抵消 Opus 5.5 在成本与多智能体上的优势𝕏

Teortaxes

Taelin 称在网站上也遇到 Opus 5.5 无法输出,疑似提示词触发截断或 ToS 拦截𝕏

Taelin

Taelin 报告 Opus 5.5 API 疑似无法输出,报错指向 max_tokens 截断与 ToS 反逆向限制𝕏

Taelin

Teortaxes 讽刺 Opus 新模型 token 消耗过高,称其是 token-gobbling monster(Intelligence Index)𝕏

Teortaxes

Artificial Analysis 发布 Claude Opus 5.5 在 Intelligence Index 各推理档位的分项评测𝕏

Artificial Analysis
同日另有 1 条同源
  • Artificial Analysis 拆解 Claude Opus 5.5 在 Intelligence Index 各推理档位的单项评测𝕏
每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 11:15