有变化Grok 4.7是否已能作为日常工作模型
Elon Musk · 9月22日 Elon Musk 称 Grok 4.7 是智能、速度与低成本的良好组合𝕏
Elon Musk · 9月22日 Elon Musk 称 Grok 4.7 在 agentic coding 上排第三,仅次于 Anthropic 与 OpenAI(GPT-5.6)(Intelligence Index)𝕏
Elon Musk · 9月22日 Elon Musk 称 Grok 4.7 在自家 Build harness 中表现极佳𝕏
Teortaxes · 9月22日 Teortaxes:Grok 4.7 表现糟糕,印证算力至上论——xAI 有钱、硬件、电力、数据和 CEO 意志仍不够𝕏
Teortaxes · 9月22日 Teortaxes 对 Grok 4.7 在 Vals Index 降至 54.2%、排名第 24 表示担忧𝕏
Teortaxes · 9月22日 Teortaxes 判断 grok-4.7 在 22 项知识工作任务内部评测中排第 3、成本低于 $5,但仍落后 DeepSeek V4.1 Flash𝕏
Artificial Analysis · 9月22日 Artificial Analysis 测得 Grok 4.7 在 Intelligence Index 得 46 分,较 Grok 4.6 提升 2 分并超越 GPT-5.6 Sol𝕏
Teortaxes · 9月22日 Teortaxes 称 xAI 更新 SDK 后 Vals Index 升至第 10,但部署表现尴尬𝕏
Elon Musk · 9月22日 Musk 称 Grok 4.7 搭配 Build harness 是强力日常主力𝕏
Elon Musk · 9月22日 Elon Musk 称 Grok 4.7 在 Tesla 做真实工程工作𝕏
Teortaxes · 9月23日 Teortaxes 称 Elon 要求不惜代价击败 Opus,Grok 4.7 在 SWE-Together 中出现 reward hacking𝕏
Guillermo Rauch · 9月23日 Guillermo Rauch 发布 Next.js evals:Opus 5.5、GPT-6 Sol、Fable 5.1 均达 97%,Grok 4.7 为 94% 且便宜 2x-7x𝕏