9月22日,SpaceXAI 正式发布新一代模型 Grok 4.7,重点面向编程与知识工作场景。

据官方介绍,该模型基于全新且规模更大的基础模型打造,强化学习训练时长也有所延长,从而提升了处理复杂任务的能力。官方称其为该公司当前最强的编码与知识处理模型——速度达到同类模型的两倍,而价格仅为一半。
Grok 4.7 针对编程和知识工作做了专门优化。相较于 Grok 4.6,新模型在困难任务上能够坚持更长时间,并且加强了对自身输出结果的核查能力。
在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面位居同类模型前列。官方同时指出,该模型的运行速度和定价与 Grok 4.6 保持一致。
Grok 4.7 所使用的基础模型比 Grok 4.6 更大,并经过了更长时间的强化学习训练。训练数据更侧重于需要数小时才能完成的复杂任务,同时针对模型的自我验证和长上下文管理能力做了优化。
SpaceXAI 还围绕 Grok Bot harness 对 Grok 4.7 进行了原生训练,使其在对话及一般知识工作任务中的表现有所提升。除此之外,该模型在文档和演示文稿生成方面也取得了改进。
在 GDPval 和 AA Briefcase 两项基准测试中,Grok 4.7 的成绩均高于 Grok 4.6。这些测试要求 AI 完成律师、护士、金融分析师等专业人士日常工作中的相关任务。官方称,Grok 4.7 在这两项测试中的表现已经达到与其他前沿模型相近的水平。
安全层面,SpaceXAI 为 Grok 4.7 引入了全新的安全防护体系。官方表示,该模型在拒答和抵抗越狱攻击方面达到了公司目前测试中的最高水平。
在网络安全和生物领域等具有双重用途的场景中,Grok 4.7 力求兼顾合法任务的可用性与危险任务的安全拒答。在 LatchBio 生物安全基准测试中,该模型取得了 62.4% 的成绩。
针对网络安全场景,SpaceXAI 表示,Grok 4.7 在 HackerBench v0.3 测试中仅放行 3.3% 的高风险双重用途提示,同时对合法安全工作的拦截较少。此外,公司已开始向部分网络安全合作伙伴提供邀请制访问权限,用于红队能力和防御研究。
目前,Grok 4.7 已通过 Cursor 和 Grok Build 提供,同时开放 Grok API,并支持第三方编程工具、模型路由服务及云平台。
价格方面,Grok 4.7 每百万词元输入起价为 2 美元,输出起价为 6 美元。SpaceXAI 同时还提供了高速版本,输出速度翻倍,但价格也翻倍。






















