Artificial Analysis 示例:Grok 4.6 估值分析直接命中交易合伙人速算值,Grok 4.7 独立跑估值链并标出问题𝕏
Artificial Analysis9 月 24 日Grok 4.7 在 AA 估值链示例中独立跑完流程并标出问题,Grok 4.6 直接落在交易合伙人速算值上
Grok 4.7 在 AA 估值链示例中独立跑完流程并标出问题,Grok 4.6 直接落在交易合伙人速算值上
Grok 4.7 已上线 Grok Build、Cursor 与 API,价格与 4.6 相同
疑似或传闻 当事方还没回应迹象指向 依据接口、代码提交等公开痕迹作出的推断转述 二手说法,不是原话
事件
| 看什么 | 现在的情况 | 依据 |
|---|---|---|
| 事实 | Grok 4.7 已上线 Grok Build、Cursor 与 API,价格与 4.6 相同 | |
| 后果 | 跑 PE deck、估值链这类知识工作可换 4.7 试,3D 生成类任务先留在 4.6 | |
| 官方 | 尚未表态 |
Artificial Analysis实测另一个 PE deck 示例中 4.6 只用最新一年数据、无营收趋势与汇率讨论,4.7 则评估完整三年历史并得出增长被抹平的结论𝕏
Teortaxes实测他在 Grok Build 里对比 4.7 high 与 4.6 high 的 3D 生成(空客 H145 直升机模型),称疑似降级且极耗 token𝕏
TestingCatalog转述他称 Grok 4.7 在部分任务上接近 Opus 5 性能𝕏
产业解读
这不是投资建议。
Teortaxes:Grok 4.7 未在任何 bench 上比 Grok 4.6 更省 token,xAI 快速换代导致配方无法调试𝕏
更早
Artificial Analysis 示例:Grok 4.6 估值分析直接命中交易合伙人速算值,Grok 4.7 独立跑估值链并标出问题𝕏
Artificial AnalysisTeortaxes:Grok 4.6 不差,但 xAI 有钱、硬件、电力、数据和 CEO 意志仍不够,算力至上的多年验证继续成立𝕏
TeortaxesArtificial Analysis:Grok 4.7 (xhigh) 的 AA-Omniscience 幻觉率降至 29%,低于 Grok 4.6 (high) 的 34%𝕏
Artificial AnalysisArtificial Analysis:Grok 4.7 (xhigh) 在 Intelligence Index 得 46,每任务输出 81k tokens,是 Grok 4.6 (xhigh) 36k 的两倍多(GPT-6)𝕏
Artificial AnalysisGrok 4.7 (xhigh) 在 Artificial Analysis Coding Agent Index 得分 56,较 Grok 4.6 (xhigh) 的 47 提升(v1.1)𝕏
Artificial AnalysisArtificial Analysis 测得 Grok 4.7 在 AA-Briefcase 得 1657 Elo,较 Grok 4.6 (high) 提升 111,仅次于 Claude Opus 5 与 Claude Fable 5.1𝕏
Artificial AnalysisArtificial Analysis 测得 Grok 4.7 在 Intelligence Index 得 46 分,较 Grok 4.6 提升 2 分并超越 GPT-5.6 Sol𝕏
Artificial AnalysisxAI 发布 Grok 4.7,称同价同速下较 Grok 4.6 明显提升𝕏
xAI关注后可跟此人更新与他说过的话,需用手机号登录