上周日,埃隆·马斯克在X平台宣布,其旗下最新大语言模型Grok 4.5已在SpaceX和特斯拉内部启动Beta测试,全面公测还需等待。
值得关注的是,据马斯克透露的早期评测数据显示,Grok 4.5性能已接近甚至部分超越Anthropic旗舰模型Claude Opus。同时,强化学习(RL)持续为模型赋能,效果显著提升。配套的「Grok Build」测试基准也在不断完善。

马斯克还释放重磅消息:SpaceX计划在今年剩余时间内,每月发布一个「从零开始训练」的全新AI模型。这并非小修小补,而是完全重新训练的基础模型,意味着未来版本可能并非Grok 4.5的简单迭代,而是一套全新基座。
如此更新节奏,将AI军备竞赛推向新高度。马斯克承诺每月推出全新模型,表明xAI正在执行极其激进的研发周期,这无疑将加剧与OpenAI、Anthropic、谷歌等竞争对手的对抗。
重视软件开发
具体而言,Grok 4.5基于1.5万亿参数的V9基础模型,并在补充训练中引入了热门AI编程工具Cursor的数据。Beta测试属于有限试用,旨在让开发者提前发现bug并收集反馈。尽管缺乏详细技术信息,但加入Cursor数据显然是为了强化软件开发能力——这是大模型最重要的商业应用场景之一。
本月16日,SpaceX宣布以600亿美元收购AI编程公司Anysphere(即Cursor母公司),此举旨在加速企业级AI市场布局,收购预计于2026年第三季度完成。值得注意的是,今年3月,Cursor的两名产品工程负责人已加入SpaceX,参与月球项目及xAI研发。
这一系列动作背后,是xAI持续扩张AI基础设施,将Grok打造为生成式AI市场的强劲竞争者。先在SpaceX和特斯拉内部测试,可在大规模部署前获取真实工程、制造及软件开发场景的实战经验。

