埃隆·马斯克为SpaceXAI的Grok系列模型设定了8月初的发布目标,并披露了更大规模Grok 4.7模型的计划,以加大与OpenAI、Anthropic以及中国Moonshot AI的竞争。据马斯克7月28日在X平台上的帖子,Grok 4.6将于“8月7日左右”发布,这是一款1.5万亿参数的模型,具有更强的监督微调和强化学习能力。监督微调通过精选样本训练模型以提升回答质量,强化学习则利用反馈和奖励信号优化模型处理任务和遵循指令的方式。
马斯克还表示,Grok 4.7将在“几周后”作为一款2.1万亿参数的模型推出,但他未提供确切发布日期或定价与可用性细节。马斯克称Grok 4.7“在各方面都将优于4.6,只是服务速度稍慢,但代币效率更高”。两个日期均为目标而非确认的发布安排,模型开发进度可能在训练、测试和部署过程中发生变化。
SpaceXAI于7月初推出了Grok 4.5,该模型专为编程、代理任务和知识工作设计,当前定价为每百万输入代币2美元、每百万输出代币6美元。马斯克宣布下一代模型是为了回应Vercel CEO Guillermo Rauch的评估,后者称Grok 4.5在其最新测试中是性价比最高的网络安全模型,比OpenAI的GPT-5.6 Sol便宜10倍,比Anthropic的Opus 5便宜5.7倍,比Moonshot的Kimi K3便宜2.2倍,且性能接近Kimi。Rauch仍将Sol列为领先的前沿模型,高于Opus 5。该结果反映Vercel的测试方法,不代表所有AI工作负载的通用排名。SpaceXAI尚未说明Grok 4.6和4.7是否保留Grok 4.5的定价。
Grok的升级计划正值中国开发者缩小与美国领先AI公司差距之际。Moonshot AI于7月27日发布了Kimi K3的完整权重,允许开发者下载、修改并在自有基础设施上运行模型。Kimi K3拥有2.8万亿参数、原生视觉能力和100万代币的上下文窗口,其规模和开放权重结构给主要通过封闭平台和付费API分发最先进模型的美国公司增加了压力。SpaceXAI、OpenAI和Anthropic还在编程、网络安全、推理以及完成每项任务所需的成本上展开竞争。Grok 4.7的更大架构可能提升能力,但马斯克承认其服务速度将慢于Grok 4.6。参数数量本身并不决定模型质量,训练数据、架构、后训练方法、推理系统和代币效率都会影响性能。
在监管方面,OpenAI和Anthropic已同意向美国官员提供未发布前沿模型的早期访问用于安全测试,该协议构成了更广泛的联邦自愿审查框架的基础,现涵盖SpaceXAI、Google DeepMind和微软。特朗普总统于6月通过行政命令将框架正式化,参与公司可在向可信合作伙伴发布前将相关模型交给联邦政府最多30天。命令明确审查不创建强制许可或预先审批制度。然而,业界对华盛顿应如何处理开放权重模型仍存在分歧。英伟达、微软、Meta、OpenAI、Palantir等组织在7月24日的公开信中警告政策制定者不要实施广泛限制,认为开放模型支持竞争、降低部署成本,并允许开发者在自有基础设施上运行和修改AI系统。在Moonshot AI发布2.8万亿参数的Kimi K3后,辩论愈演愈烈。特朗普政府官员指控Moonshot通过大规模蒸馏使用Anthropic的Fable模型输出训练Kimi K3,白宫技术顾问Michael Kratsios称此举试图获取美国专有技术,财政部长Scott Bessent表示政府正考虑制裁并将Moonshot列入贸易黑名单。Moonshot尚未公开承认这些指控,但该争端已使Kimi K3成为更广泛政策斗争的核心,即华盛顿是应针对特定安全和知识产权风险,还是更广泛地限制对中国开放权重模型的访问。Grok 4.6和4.7将进入这个市场,美国开发者面临提升性能同时满足新兴联邦安全期望的压力。
