导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

xAI发布Grok 4.7:2.1万亿参数登场,性能仍落后头部但主打低价普及

xAI于周一午后正式发布Grok 4.7,称这是其迄今最强模型,并形容该模型“在相同价格和速度下较Grok 4.6有明显提升”。此次发布此前多次延期,马斯克自7月底以来至少五次调整时间表,从“四周后”到“几周后”、再到“10天”和“还需几天”,最终于本周一上线。

Myriad: How much will Elon Musk be worth? Click to make your prediction.

与Grok 4.6相比,Grok 4.7强调更长时间处理难题,并更频繁地复核自身答案,同时配备xAI所称迄今最强的安全护栏。马斯克随后在X上表示,Grok 4.7是“智能、速度与低成本的强组合”。本次发布没有等待名单,已上线Grok应用、Cursor、Grok Build和xAI API。

参数、定价与可用范围

Grok 4.7拥有2.1万亿参数,较Grok 4.6的1.5万亿增加40%。Grok 4.6本身是Grok 4.5的改进版。定价为每百万输入token 2美元、每百万输出token 6美元。参数是模型训练中调节的内部旋钮,通常越多意味着学习模式的能力越强;token则是AI模型可登记或生成的基本信息单位。

引入SpaceX数据,强化硬件推理

xAI还将来自SpaceX的补充训练数据纳入模型,包括Starlink卫星遥测、制造记录和工程失败日志。其目标是让模型在硬件和物理系统推理方面,优于纯粹使用互联网文本训练的模型。

Grok 4.7 Arrives With 2.1T Parameters as xAI Plays Catch-Up in AI Race

基准测试仍落后于头部竞品

不过,基准测试呈现出熟悉的结果。GDPval衡量模型在真实且具经济价值的知识工作上的表现,包括法律备忘录、电子表格和幻灯片,由各领域在职专业人士审核任务,并以棋类常用的Elo等级分排名。Grok 4.7在GDPval上得分1695,Claude Fable 5.1以1735居首。Artificial Analysis推出的AA-Briefcase测试多小时的办公任务,将研究、分析和文档制作串成长任务,同样采用Elo评分。Grok 4.7得分1657,Fable 5.1为1678。

在Cursor面向编辑器内真实编程任务的CursorBench 4.0中,Grok 4.7处于中游:每项任务成本高于GPT-5.6 Sol的继任者GPT-6 Astra和Claude Sonnet 5,但仍不及Fable 5.1。Fable 5.1在该图表的每个价格点上均胜出。

xAI的追赶与市场定位

这对xAI并非新格局。Grok 4.5于7月发布时,虽拥有业内最大训练集群,但得分仍排在Claude和OpenAI模型之后。更早的Grok 4.20在可靠性与速度、个性之间取舍,Grok 4.6也在编程自主性上落后前沿阵营。尽管如此,这并不妨碍Grok 4.7成为通过X、独立应用或特斯拉仪表盘与数百万用户互动的产品。

对多数普通用户而言,价格可能比排行榜位置更重要。xAI一直在每token成本上低于Anthropic和OpenAI,即便原始能力仍落后,其押注的是“够用、便宜、无处不在”能胜过大体量日常使用场景中的“最好但更贵”。

马斯克在发布前已降低预期,称Grok 4.7应“大致与”Anthropic的Claude Opus 5.0持平,而非更新的Opus 5.1,多模态表现仍需改进。他在同一帖文中勾勒了后续三代模型:Grok 4.8将有意义的提升,Grok 4.9达到“Astra/Fable级别”,Grok 5可能成为前沿领先者。这些升级尚无发布日期,马斯克写道:“我们拭目以待。”