xAI据报发布Grok 4.7,性能仍落后部分竞品
报道称xAI已发布Grok 4.7并上线多个平台;其参数、定价及基准成绩等细节目前仅见于所给二手报道。
快讯正文
xAI发布Grok 4.7:参数规模增至2.1万亿,基准测试仍落后Claude
动察 Beating AI 快讯,xAI 周一正式发布 Grok 4.7,官方称其在同等价格和速度下较 Grok 4.6 有「显著提升」。Grok 4.7 此前至少经历 5 次延期,目前已上线 Grok 应用、Cursor、Grok Build 及 xAI API。
Grok 4.7 参数规模达到 2.1 万亿,较 Grok 4.6 的 1.5 万亿增加 40%,输入和输出价格分别为每百万 Token 2 美元和 6 美元。xAI 还引入 SpaceX 补充训练数据,包括 Starlink 卫星遥测数据、制造记录和工程故障日志,旨在提升模型对硬件及物理系统的推理能力。
基准测试方面,Grok 4.7 在 GDPval 和 AA-Briefcase 中均排名第二,得分分别为 1695 和 1657,均落后 Claude Fable 5.1 的 1735 和 1678;在电气工程基准测试 EEBench 中则排名第二,仅次于 GPT-6 Astra。CursorBench 4.0 显示,Grok 4.7 的任务成本高于 GPT-6 Astra 和 Claude Sonnet 5,同时整体表现仍落后 Fable 5.1。
马斯克此前曾表示,Grok 4.7 的水平大致相当于 Claude Opus 5.0,但尚未达到更新版本 Opus 5.1 的水平,并透露 Grok 4.8、4.9 及 Grok 5 正在开发中。
原文链接 https://m.theblockbeats.info/flash/368305
补充解读
消息来自专业媒体快讯,但给定材料未附xAI官方公告、模型卡、API文档或可复核的基准测试链接;参数规模、训练数据来源和竞品排名等关键说法均缺少一手证据。候选事件与本事件主体和触发原因不同,不构成重复。
关注后续官方信息,不根据单一消息做决定。
xAI官网、官方账号或API文档是否确认Grok 4.7的上线、上下文规格与价格
是否发布模型卡或披露2.1万亿参数及SpaceX训练数据的合规依据
GDPval、AA-Briefcase、EEBench和CursorBench是否提供可复核结果
第三方评测对性能、成本和速度的验证情况
同事件进展
正在加载事件时间线…