Grok 4.6定于8月7日发布,Grok 4.7紧随其后:SpaceXAI加速AI竞争
埃隆·马斯克已为Grok 4.6设定了8月初的发布目标,并披露了更大规模Grok 4.7模型的计划,SpaceXAI正加速与OpenAI、Anthropic以及中国Moonshot AI的竞争。据马斯克透露,Grok 4.6预计于8月7日左右发布,该模型将拥有1.5万亿参数并改进后训练技术。Grok 4.7可能在几周后推出,参数规模达2.1万亿。
马斯克在7月28日于X平台发布的帖子中公布了时间线,称Grok 4.6将“在8月7日左右”发布。他将其描述为1.5万亿参数模型,具有更强的监督微调和强化学习能力。监督微调通过精选示例训练模型以提高响应质量;强化学习则利用反馈和奖励信号优化模型处理任务和遵循指令的方式。马斯克还表示,Grok 4.7将在“几周后”作为2.1万亿参数模型推出,但他未提供确切发布日期,也未透露这两款模型的定价和可用性细节。“这将在各方面优于4.6,除了服务速度稍慢,但令牌效率更高,”马斯克在谈到Grok 4.7时表示。这两个日期目前仍是目标,而非确认的发布安排。模型开发进度可能在训练、测试和部署过程中发生变化。
Grok 4.5为升级奠定了基准。SpaceXAI于7月初推出了Grok 4.5,该模型专为编码、智能体任务和知识工作设计。公司目前收费为每百万输入令牌2美元,每百万输出令牌6美元。马斯克宣布下两个模型是为了回应Vercel首席执行官Guillermo Rauch的评估,Rauch称Grok 4.5是Vercel最新测试中性价比最高的网络安全模型。根据Rauch的帖子,Grok 4.5比OpenAI的GPT-5.6 Sol便宜10倍,比Anthropic的Opus 5便宜5.7倍,比Moonshot的Kimi K3便宜2.2倍,同时性能接近Kimi。Rauch仍将Sol列为领先的前沿模型,优于Opus 5。他的发现反映了Vercel的测试方法,并不构成所有AI工作负载的通用排名。SpaceXAI尚未说明Grok 4.6和Grok 4.7是否会保持Grok 4.5的定价。服务速度、令牌使用量和API成本将决定新模型能否保持相同的性价比优势。
美国AI公司面临来自中国Kimi K3的压力。Grok的计划升级发生在中国开发者缩小与领先美国AI公司差距的背景下。Moonshot AI于7月27日发布了Kimi K3的完整权重,允许开发者下载、修改并在自己的基础设施上运行该模型。Kimi K3拥有2.8万亿参数、原生视觉能力和100万令牌的上下文窗口。其规模和开放权重结构给主要通过封闭平台和付费API分发最先进模型的美国公司带来了压力。SpaceXAI、OpenAI和Anthropic也在编码、网络安全、推理以及完成每个任务的成本方面展开竞争。Grok 4.7更大的架构可能提升其能力,但马斯克承认其服务速度将慢于Grok 4.6。参数数量本身并不能决定模型质量。训练数据、架构、后训练方法、推理系统和令牌效率都会影响性能。
美国AI公司在联邦监管问题上存在分歧。OpenAI和Anthropic已同意向美国官员提供未发布前沿模型的早期访问权限以进行安全测试。这些协议构成了更广泛的自愿联邦审查框架的基础,该框架现已涵盖SpaceXAI、Google DeepMind和微软等其他主要开发者。美国总统唐纳德·特朗普通过6月的一项行政令正式确立了该框架。参与公司可以在向可信合作伙伴发布受覆盖模型之前,将其提供给联邦政府最多30天。行政令指出,这些审查不构成强制性许可或预审批制度。然而,业界对于华盛顿应如何处理开放权重模型仍存在分歧。英伟达、微软、Meta、OpenAI、Palantir等组织在7月24日的一封公开信中警告美国政策制定者不要实施广泛限制。他们认为开放模型支持竞争、降低部署成本,并允许开发者在自己的基础设施上运行和修改AI系统。在Moonshot AI发布2.8万亿参数的Kimi K3后,这场争论愈演愈烈。特朗普政府官员指责Moonshot通过大规模蒸馏使用Anthropic的Fable模型的输出来训练Kimi K3。白宫技术顾问Michael Kratsios将这种所谓的行为描述为试图获取美国专有技术,而财政部长Scott Bessent则表示政府正在考虑制裁并将Moonshot列入贸易黑名单。Moonshot尚未公开承认这些指控。尽管如此,这场争端使Kimi K3成为更广泛政策斗争的核心,争论焦点在于华盛顿是应该针对特定安全和知识产权风险,还是更广泛地限制对中国开放权重模型的访问。Grok 4.6和Grok 4.7将进入这个市场,美国开发者面临提升性能同时满足新兴联邦安全期望的压力。
