2026年9月21日,xAI发布了旗舰模型的新版本Grok 4.7。xAI称,这是其在编程和知识工作方面性能最强的模型。
主要改进
根据官方公告,Grok 4.7采用了比Grok 4.6更大的全新基础模型。此外,xAI使用包含大量需耗时数小时才能完成的高难度任务的训练数据,进行了比以往更长时间的强化学习。
官方表示,由此带来了以下改进。
- 能在高难度任务上投入更长时间
- 能更仔细地检查自己的工作成果
- 能更好地处理长上下文
- 更擅长制作文档和演示文稿
主要数据
xAI公布的主要数据如下。
- 编程评测CursorBench 4.0得分46.3%(Grok 4.6为40.4%)
- 软件开发评测DeepSWE v1.1得分71.0%(Grok 4.6为65.2%)
- 法律评测Harvey Legal Agent Benchmark得分19.6%(Grok 4.6为15.8%)
- 临床推理评测HealthBench Professional得分56.7%(Grok 4.6为48.5%)
安全方面,Grok 4.7配备了全新重构的安全防护措施。xAI称,在其测试过的模型中,该模型拒绝不当请求和抵御越狱攻击的能力最强。以上数据均来自xAI官方公告。
价格与上线平台
API价格为每百万token输入2美元、输出6美元起。另有输出速度翻倍的高速版,价格为标准版的两倍。
Grok 4.7可在Cursor、xAI的开发工具Grok Build和Grok API中使用,也可通过第三方编程工具、模型路由服务和云服务调用。
CoAI编辑部观点
此次发布明显瞄准开发者和企业应用。从发布当天即可在Cursor中使用这一点,也能看出xAI意在争取编程场景的采用。与其他主流模型比较时,除了价格,也建议查看与自身用途相近的基准测试结果。