9 月 24 日

厂商

Google DeepMind

投资者视角 · 只摆公开事实与变化,不是投资建议。

关键数字
DeepMind 工作模型智能指数Gemini 3.1 Pro Preview(current_models 工作档);AA Intelligence Index v4.3 榜单显示 30,精确 30.3630.02026-09-18
在跟的事 · 3 件最新说法
无变化3.8 Flash真实编码能不能用还是只刷公开榜
无变化3.8 Live现在能不能换掉3.1 Live来用
无变化Gemini 4现在能不能用到还是仍是筹备传闻
Max For AI9/18 称假期前名单含Gemini 4 Pro,并称3.8速度已明显下降𝕏

另有 3 件未展开

无变化3.8 Flash真实编码能不能用还是只刷公开榜

何时见分晓:独立编码基准复测
TeortaxesLogan Kilpatrick 说法不一
Teortaxes · 9月8日
称3.8 Flash在TB 4.0上明显差于2.1,属公开榜刷分
Logan Kilpatrick · 9月3日
CursorBench 3.2得69.2%,超Fable 5,无公开仓库可刷

无变化3.8 Live现在能不能换掉3.1 Live来用

何时见分晓:下一次语音盲测复测
Logan Kilpatrick · 9月16日
称3.8 Live与Extended Thinking为新SOTA语音模型
Artificial Analysis · 9月16日
盲测Elo 1083首秀第2,仍落后3.1 Flash Live的1096

无变化Gemini 4现在能不能用到还是仍是筹备传闻

何时见分晓:官方发布窗口未到
Max For AITeortaxes 说法不一
Max For AI · 9月18日
称假期前名单含Gemini 4 Pro,并称3.8速度已明显下降
Teortaxes · 9月18日
疑似4家族基准页像灌水;要看前沿推理再谈能用

Max For AI · 9月18日 Max For AI 判断 Gemini 4 即将发布,并称 Gemini 3.8 速度明显下降𝕏

Teortaxes · 9月18日 Teortaxes 称见到疑似 Gemini 4 家族基准页,4 Flash 表现压过 Fable 5.1,但认为内容不可信故不转发𝕏

Teortaxes · 9月18日 Teortaxes:Gemini 4 的多模态能力已被市场定价,除非展示前沿推理能力否则不值得期待𝕏

Teortaxes · 9月17日 Teortaxes 质疑 Gemini 4 Pro 在 Arena 以 gemini-3.8-flash 名义仅用 pelican 骑车 SVG 题测试𝕏

TestingCatalog · 8月24日 TestingCatalog:Gemini 4 准备已开始,检测到 120+ 新提及𝕏

Max For AI · 9月20日 Max For AI 汇总中秋国庆前将发布 Claude Fable5.2、GPT6 Sol、Gemini 4 Pro、Kimi K3.1、Qwen-4 等模型(DeepSeek-V4.1)(Grok4.7)(Step-5)𝕏

我们只标出对不上的地方,不下结论。出处是中文摘要。由模型梳理后经引用校验,未逐条人工复核。

近期要闻

谁在跟踪

这不是投资建议。

每早一封:昨夜到今晨新增的几件事,每件一行,点开回站点看完整。
HOURAHEAD关于 · 往期 · 2026-09-24 12:54