导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜 概念版块
快讯 机构 人物 观点 专题

xAI发布Grok 4.7:参数更大却迟到的AI前沿竞争者

xAI正式发布Grok 4.7:参数提升40%,但基准测试仍稍逊前沿

埃隆·马斯克(Elon Musk)旗下的人工智能公司xAI于周一(9月21日)下午发布了Grok 4.7模型。该公司称这是其迄今为止最强大的模型,并表示该模型“在与Grok 4.6相同的价格和速度下实现了显著改进”。然而,此次发布经历了数次明显的延迟。自7月下旬以来,马斯克至少五次推迟了时间表:从“四周后”、“几周后”、“3到4周”、9月1日的“10天”,到9月11日的“还需要几天打磨”。

Myriad: How much will Elon Musk be worth? Click to make your prediction.

Myriad:埃隆·马斯克将拥有多少财富?点击做出你的预测。

xAI表示,与Grok 4.6相比,新模型在处理难题时会花费更长时间,并更频繁地复核自身答案,同时配备了公司所称“史上最强的安全护栏”。马斯克在X平台跟进称,Grok 4.7是“智能、速度与低成本的有力结合”。本次发布没有等待名单,模型已直接在Grok应用、Cursor、Grok Build以及xAI API中上线。

据披露,Grok 4.7包含2.1万亿参数,较Grok 4.6的1.5万亿(本身基于Grok 4.5优化)增加40%。其定价为每百万输入token收费2美元,每百万输出token收费6美元。参数指模型训练时调整的内部变量,通常越多代表学习能力越强;token则是模型处理或生成信息的基本单位。

xAI还融入了来自马斯克火箭公司SpaceX的补充训练数据,包括星链卫星遥测、制造记录和工程故障日志,旨在让模型比纯互联网文本训练的模型更擅长推理硬件与物理系统。

xAI发布Grok 4.7:参数更大却迟到的AI前沿竞争者

不过,基准测试结果呈现出熟悉的格局。在衡量真实经济价值知识工作(法律备忘录、电子表格、演示文稿)的GDPval测试中,Grok 4.7获得1695分(Elo评级),而Claude Fable 5.1以1735分位居榜首。由Artificial Analysis构建的AA-Briefcase测试模拟多小时办公任务,Grok 4.7得1657分,同样低于Fable 5.1的1678分。在Cursor编辑器的真实编码基准CursorBench 4.0中,Grok 4.7处于中游:单任务成本高于GPT-6 Astra和Claude Sonnet 5,但准确性仍不及在各个价位均占优的Fable 5.1。

这并非xAI的新模式。Grok 4.5于7月携最大训练集群登场却仅排第三;Grok 4.20以可靠性换取速度与个性;Grok 4.6在编码自主性上亦落后。对于通过X、独立应用或特斯拉车机使用Grok的数百万用户而言,4.7并非劣品,但意味着最常回答他们问题的系统,在其制造商自家的基准中略低于顶尖水平。正因如此,对大多数人来说,价格比排行榜名次更重要。xAI始终以更低token成本竞争,押注“够用、便宜、无处不在”胜出“最佳但更贵”。

马斯克在发布前几天已降低预期,称Grok 4.7大致与Anthropic的Claude Opus 5.0(而非更新的5.1)持平,多模态表现仍有待提升。他同时勾勒了后续三款模型:Grok 4.8将明显步进,Grok 4.9可达“Astra/Fable级别”,Grok 5或成前沿领导者。这些升级尚未有发布日期,“我们拭目以待”,他写道。