9 月 24 日

厂商

Anthropic

投资者视角 · 只摆公开事实与变化,不是投资建议。

刚才看的:Jack Clark 称 Dario 的减速主张符合技术轨迹,AI 进展

关键数字
Anthropic 旗舰智能指数Claude Fable 5.1 (max with fallback);AA Intelligence Index v4.3 榜单显示 53,精确 53.3753.02026-09-18

比上次:多了 2 件,有变化 2

在跟的事 · 3 件最新说法
有变化Fable5.1长任务进步是否已被简单题失败打脸
有变化Claude主导26%研发能否当作RSI进度尺子
Anthropic9/18 公布三项测量:AI做了多少AI研发等,用以向公众追踪自我改进𝕏
新增Opus5.5该不该换下Fable旗舰尺子

另有 3 件未展开

有变化Fable5.1长任务进步是否已被简单题失败打脸

何时见分晓:本月真实编码任务对照
Ethan MollickTaelin 说法不一
Ethan Mollick · 9月2日
Fable 5.1在需判断力的长期任务上是真正进步,Claudish提升有限
Taelin · 9月6日
Fable 5.1与GPT 6在他5分钟可解的问题上过夜失败,尚未达AGI

Ethan Mollick · 9月2日 Ethan Mollick:Claude Fable 5.1 在需判断力的长期任务上进步显著,但 Claudish 风格提升有限𝕏

Taelin · 9月6日 Taelin:Fable 5.1 与 GPT 6 在 5 分钟可解问题上失败,说明尚未达 AGI𝕏

Ethan Mollick · 9月22日 Ethan Mollick 用 Claude Fable 5.1 生成《荒原》多路径注释指南𝕏

Ethan Mollick · 9月23日 Ethan Mollick 用 Fable/Opus 做出硬科幻星舰战斗游戏,含轨道力学、delta-v、热量与 2D 简化战术𝕏

有变化Claude主导26%研发能否当作RSI进度尺子

何时见分晓:三项指标下次官方披露
AnthropicNathan Lambert 说法不一
Anthropic · 9月18日
公布三项测量:AI做了多少AI研发等,用以向公众追踪自我改进
Nathan Lambert · 9月18日
称Claude主导26%但未定义AI R&D范围,不满足RSI问题

Anthropic · 9月18日 Anthropic 提出三项衡量 AI 自我研发进度的指标𝕏

Nathan Lambert · 9月18日 Nathan Lambert:Anthropic 称 Claude 承担 26% AI R&D 工作,但未定义 AI R&D 范围,不满足 RSI 问题𝕏

Nathan Lambert · 9月18日 Nathan Lambert 称 Anthropic 的 26% R&D 占比数字将被反复引用,并质疑其口径偏软𝕏

科技新报 · 9月18日 Anthropic 公布 Claude 已主导公司 26% 的 AI 研发工作𝕏

Arvind Narayanan · 9月22日 Arvind Narayanan:Anthropic 的图表不意味着接近智能爆炸或超级智能,任务委派≠任务𝕏

Teortaxes · 9月23日 Teortaxes 称 Opus 5.5 是首个由 RSI 训练、并从 Anthropic 内部教师模型蒸馏的模型(Model-2)𝕏

新增Opus5.5该不该换下Fable旗舰尺子

何时见分晓:本周旗舰尺子对照
AnthropicTaelin 说法不一
Anthropic · 9月23日
多数任务达Fable 5.1水平,运行成本比Opus 5低40%
Taelin · 9月23日
全部提示词上明显优于Fable 5.1,称官宣相当并不公道

我们只标出对不上的地方,不下结论。出处是中文摘要。由模型梳理后经引用校验,未逐条人工复核。

近期要闻

相关

谁在跟踪

这不是投资建议。

每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 13:41