9 月 12 日,马斯克旗下的 xAI 正式发布 Grok 4.7。相比 8 月发布的 Grok 4.6(约 1.5 万亿参数),新模型参数规模提升到 2.1 万亿,增幅约 40%。用马斯克自己的说法,它在工程与科学推理上"超越所有模型"——不过这是厂商自述,尚待独立评测验证。

用 SpaceX 数据"补真实世界"

Grok 4.7 的一个明显差异点,是用 SpaceX 的运营与工程数据做了补充训练,目标是让模型更懂真实世界的硬件、工程和物理任务,而不只是停留在通用文本推理。这也是 xAI 区别于纯互联网语料路线的打法:把自家生态里的第一手工程数据,直接喂给大模型。

不到两个月三代,逼对手跟节奏

Grok 4.5(7 月)→ 4.6(8 月)→ 4.7(9 月),不到两个月连续三代迭代,节奏明显冲着"用发布频率把对手拽进自己的时间表"去的。从第三方对 4.6 基线的评测看,它已经略超 GPT-5.6 Sol,但仍落后于 Claude Opus 5 和 Fable 5。所以 4.7 这步 2.1 万亿的"规模跳跃",本质上是赌"靠参数堆量补齐质量差距"。

对普通用户意味着什么

参数变大、推理更强的直接后果,是代码生成、技术文档理解、科学计算类任务的可用性继续提升。但也别只看数字:大模型竞赛里"宣称最强"和"实测最强"常常不是一回事,等一波独立榜单出来再下结论更稳妥。对国内用户来说,Grok 系列的可用性还取决于本地访问与合规通道,不必因为一条发布新闻就急着切换主力工具。