马斯克于本周二在X平台发布消息,迅速引发广泛关注——SpaceX积累的海量工程数据,将被用于训练Grok的下一代大模型。这并非一次小规模的补充,而是一场规模空前的“2T run”,意味着模型参数将达到约2万亿,相比当前正在推出的Grok 4.5几乎翻倍。

不过,数据并非全盘照搬。马斯克特别指出,受美国《国际武器贸易条例》限制的技术资料将被排除在外。具体来说,与国防和航天硬件直接相关的核心机密——例如梅林和猛禽发动机的推进系统、火箭制导与控制等敏感信息——不会进入训练集。但制造工艺、材料科学以及Starlink硬件设计等数据,则会大概率纳入其中。自2002年成立以来,SpaceX积累的“世界一流工程数据”如今有了新的用武之地。
事实上,这并非马斯克首次在旗下公司之间进行数据协同。特斯拉贡献了真实世界的驾驶数据与制造经验,X平台提供海量对话数据,如今SpaceX的航空航天工程数据也加入其中,构成了一套完整的训练素材库。值得关注的是,今年6月SpaceX在纳斯达克上市时,已将Grok和xAI的Colossus超级计算机作为AI战略的重要组成部分向投资者重点展示。上市后不久,SpaceX又以全股票交易方式,以600亿美元规模收购了AI编程初创公司Cursor。这笔交易帮助xAI获得了企业级软件分发渠道,同时可持续获取真实开发者的数据用于训练。
更早之前,7月8日发布的Grok 4.5已部分采用Cursor提供的数据进行训练。马斯克当时评价,Grok 4.5的整体能力大致能与Anthropic的Opus 4.7相抗衡,且运行速度更快、成本更低。如今,Grok 4.5仍在迭代,下一代模型已进入最后训练阶段——外界普遍称之为Grok 4.6,参数规模达到2万亿。马斯克透露,训练预计在本周完成,但正式发布时间尚未公布。
回顾来看,SpaceX工程数据注入Grok,既是技术层面的自然延伸,也是马斯克一贯数据协同策略的又一布局。从汽车到社交平台,再到航空航天,数据正成为他旗下公司之间最核心的“连接器”。至于这2万亿参数的模型究竟能带来怎样的效果,值得持续关注。
