9 月 24 日开源权重前沿

环节

开源权重前沿

开源权重模型前沿,与闭源差距的收敛速度

带到 ChatGPT带走
更多
关键数字
前沿模型智能指数Intelligence Index v4.2 最高分档:Fable 5.1 max with fallback。与站内性价比榜同日转录。搜索引擎里的 66 是旧尺子,不录。57.02026-09-06
在跟的事 · 3 件最新说法
无变化开源权重实践上是否仍远落后闭源前沿
无变化专项任务追平闭源是否意味综合差距已消失
无变化开源权重能否在可见期内接近闭源前沿
Teortaxes9/4 18个月内无开源能在FrontierMath T4超越Astra,DeepSeek缺算力𝕏

另有 2 件未展开

无变化开源权重实践上是否仍远落后闭源前沿

何时见分晓:下一次指数更新
Ethan MollickElvis Saravia 说法不一
Ethan Mollick · 9月10日
开源距前沿比近段更远,K3与GLM-5.3仍不及Mythos或Astra
Elvis Saravia · 9月18日
称闭源与开源差距已成过去,Bolt上GLM 5.3 Flash占54%

Ethan Mollick · 9月10日 Ethan Mollick 判断开源模型与前沿差距拉大,Mythos 与 Astra 领先𝕏

Elvis Saravia · 9月18日 Elvis Saravia 称闭源与开源模型差距已成过去,引用 Bolt 数据 GLM 5.3 Flash 占 54%𝕏

Artificial Analysis · 9月8日 Artificial Analysis:GLM-5.3 与 Kimi K3 开源权重模型 Intelligence Index 44,落后 Claude Fable 5.1 和 GPT-6 Astra 9 分𝕏

Artificial Analysis · 9月22日 Artificial Analysis:MiMo-V2.6-Pro 以 Intelligence Index 46 登顶开源权重模型,$0.13/task 落在 Intelligence vs. Cost per Task Pareto 前𝕏

无变化专项任务追平闭源是否意味综合差距已消失

何时见分晓:下一批专项任务评测
Fireworks · 9月11日
幻灯片生成追平Claude Opus 5,输入token价约其1/17
MiMo-V2.6-Pro指数46登顶开源,仍落后Fable 5.1与Astra

无变化开源权重能否在可见期内接近闭源前沿

何时见分晓:Astra级开源发布窗
TeortaxesGavin Baker 说法不一
Teortaxes · 9月4日
18个月内无开源能在FrontierMath T4超越Astra,DeepSeek缺算力
Gavin Baker · 8月29日
美国开源权重会以某种方式接近前沿

Teortaxes · 9月4日 teortaxes:18个月内无开源模型能在FrontierMath T4超越Astra,DeepSeek或有能力但缺算力𝕏

Gavin Baker · 8月29日 Gavin Baker 判断美国开源权重模型将接近前沿𝕏

Teortaxes · 9月5日 teortaxes:多数受访者认为7个月内出现Astra级开源模型,1年内最小Astra级推理模型大于Kimi K3𝕏

我们只标出对不上的地方,不下结论。出处是中文摘要。由模型梳理后经引用校验,未逐条人工复核。

这页的完整内容订阅后可见。去订阅

每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 11:14