Grok 4.7
xAI发布的Grok 4系列小版本迭代模型,在多轮对话连贯性、创意表达和推理能力上进行优化,支持通过X平台API访问实时信息
Core Facts
Timeline (last 90 days)
据传Grok 4.7的参数规模约为2.1万亿
马斯克在9月初称Grok 4.7是性能上的重大改进,并给出了10天后发布的时间点
在一项voxel bench体素基准类创意生成测试中,疑似Grok 4.7检查点的神秘模型在氛围营造、色彩渐变与创意表达等方面超越了Grok 4.6甚至Kimi K3
xAI 的 Grok 4.7 曾在 OpenCode Zen 平台短暂上线,随后被删除
在作者实测中,相同任务Haiku 5.5约20秒完成,Grok 4.7耗时约35分钟,成本约为后者五分之一
在World of AI基准平台上Haiku 5.5综合排名第10,超越Grok 4.7
该用户称仅完成调整网页界面顺序、编写测试以及用Opus 5.5修复一个由Grok 4.7引入的bug,就消耗了约21%的月度配额
马斯克的Grok 4.7未按预期发布,疑似推迟
Zed 将 Grok 4.7 加入 SuperGrok 与 xAI 提供商,并设为推荐默认模型
Argon在CWE Bench上以68%与GPT-6 Astra、Grok 4.7并列第一
40 more timeline events
All Facts (20)
Grok 4.5来自xAI,定位高端
75%Verified在DeepSuite基准上Grok 4.7得71%,GPT 5.6 Sol为72.7%,Fable 5.1为70%,Astra Max以74.1%登顶
65%Verified在 Terminal Bench 4.0 上,Opus 5.5 得分 66.4%,Astra 为 57.9%,Fable 5.1 为 55.8%,前代 Opus 5 为 52.3%
65%VerifiedxAI 的 Grok 4.5 已正式上线可用
80%UnverifiedZed 将 Grok 4.7 加入 SuperGrok 与 xAI 提供商,并设为推荐默认模型
70%UnverifiedGrok 4.7 是在 Grok 4 系列基础上的小版本迭代,而非架构层面的大改
70%Unverified据 YouTube 频道实测分析,Grok 4.7 在多项基准测试中得分低于前代 Grok 4.6
60%Unverified创作者称Grok 4.6是他见过的远远最好的编程模型
60%UnverifiedGrok 4.6的核心焦点是代码能力与知识工作(knowledge work)
60%Unverified在一项voxel bench体素基准类创意生成测试中,疑似Grok 4.7检查点的神秘模型在氛围营造、色彩渐变与创意表达等方面超越了Grok 4.6甚至Kimi K3
50%Unverified据传Grok 4.7的参数规模约为2.1万亿
50%Unverified在作者实测中,相同任务Haiku 5.5约20秒完成,Grok 4.7耗时约35分钟,成本约为后者五分之一
50%Unverified在World of AI基准平台上Haiku 5.5综合排名第10,超越Grok 4.7
50%UnverifiedArgon在CWE Bench上以68%与GPT-6 Astra、Grok 4.7并列第一
50%UnverifiedGrok 4.7在企业文档解析任务上触及前沿水平
50%UnverifiedDatabricks官方未给出GPT-6.1 Sol与Grok 4.7的完整基准成绩与技术细节数据
50%Unverified在改进T3 code的测试中,6.1 Sol得87.4分(Astra 83.8,Grok 4.7 80.7),成本仅2.15美元,而Opus 5.5需5美元、Sonnet 5.5近9美元
50%Unverified在T3代码改进任务中,GPT-6.1 Sol以87.4分击败Astra(83.8)和Grok 4.7(80.7),成本仅2.15美元
50%UnverifiedGrok 4.7 在两组测试中都表现偏弱,尤其网页部分效果较差
50%UnverifiedArtificial Analysis发布Cyber Index基准衡量AI模型网络防御能力,Grok 4.7与MIMO V2.6 Pro以56分并列最高
50%