时间:2026-09-21
地点:旧金山(xAI 总部)
人物:Elon Musk(xAI 创始人)
事件详情:xAI 于 9 月 21 日正式发布 Grok 4.7 模型,主打编码与知识工作场景,定位"迄今为止最强版本"。新模型采用比 Grok 4.6 更大的基础架构,叠加更长周期的强化学习训练,重点提升"自校验"与"长上下文管理"两项能力,并新增对 Grok Bot 工具链的原生理解。价格维持与 4.6 持平:输入 2 美元/百万 token,输出 6 美元/百万 token,仅为 GPT-5.6 Sol(4/20 美元)的 1/3、Fable 5.1(10/50 美元)的 1/5。xAI 同时推出"提速版",输出速度翻倍但价格也翻倍。
背景:xAI 在 8 月 12 日刚推出 Grok 4.6,本次属于 6 周内第二次大版本迭代。Grok 4.6 已在 GitHub Copilot、Amazon Bedrock、Gemini Enterprise Agent Platform、Microsoft Foundry 上架。Grok 4.7 进一步把"超长任务"作为差异化卖点——目标用户群是长时间运行的 AI 编码 Agent,Grok Bot 已于 8 月 11 日发布,被定位为"永不停歇的代理团队"。
影响:基准层面,Grok 4.7 在 CursorBench 4.0 上得 46.3%(4.6 为 40.4%),Terminal-Bench 4.0 得 38.0%(4.6 为 20.3%,近乎翻倍),DeepSWE v1.1 高算力下得 71.0%;但 Fable 5.1 在 Terminal-Bench 仍以 57.9% 领先,Grok 在 agent 编码上与第一梯队仍有 30+ 分差距。安全方面,HackerBench v0.3 仅放行 3.3% 风险提示,LatchBio 生物安全测试得 62.4% 为业内最高。xAI 已向选定网安合作伙伴开放 red-team 能力用于防御研究。
总结:Grok 4.7 不是参数怪兽,而是一份"价格不变、性能小步、安全大跨"的中期升级。xAI 把赌注压在"长任务 + 低价 + 安全"三件套上,试图在 GPT-6、Fable、Opus 之外开辟一条性价比 + 工程化的细分赛道,对中国开发者与中小企业的吸引力可能高于头部模型。
参考来源:
- https://the-decoder.com/xai-launches-grok-4-7-at-bargain-prices-but-benchmarks-reveal-a-wide-gap-to-claude-and-gpt-6/
- https://x.ai/news/grok-4-7
- https://artificialanalysis.ai/models/grok-4-7
- https://openrouter.ai/x-ai/grok-4.7
- https://www.unite.ai/spacexai-releases-grok-4-7-for-coding-and-knowledge-work/
- https://news.lavx.hu/article/grok-4-7-targets-long-coding-tasks-at-lower-token-costs
- https://aventure.vc/news/2026-09-21-spacexai-releases-grok-4-7-which-it-says-is-better-at-verifying-its-own-work-and-managing-longer-context-available-for-2-1m-input-and-6-1m-output-tokens
- https://coindesk.cc/xai-launches-grok-4-7-with-stronger-coding-and-knowledge-work-performance-116996.html







