[KongchangAI]
Model

Grok 4.7

xAI发布的Grok 4系列小版本迭代模型,在多轮对话连贯性、创意表达和推理能力上进行优化,支持通过X平台API访问实时信息

Core Facts

Timeline (last 90 days)

Oct 8

据传Grok 4.7的参数规模约为2.1万亿

Unverified50%
Oct 8

马斯克在9月初称Grok 4.7是性能上的重大改进,并给出了10天后发布的时间点

Unverified50%
Oct 8

在一项voxel bench体素基准类创意生成测试中,疑似Grok 4.7检查点的神秘模型在氛围营造、色彩渐变与创意表达等方面超越了Grok 4.6甚至Kimi K3

Unverified50%
Oct 8

xAI 的 Grok 4.7 曾在 OpenCode Zen 平台短暂上线,随后被删除

Unverified50%
Oct 8

在作者实测中,相同任务Haiku 5.5约20秒完成,Grok 4.7耗时约35分钟,成本约为后者五分之一

Unverified50%
Oct 8

在World of AI基准平台上Haiku 5.5综合排名第10,超越Grok 4.7

Unverified50%
Oct 7

该用户称仅完成调整网页界面顺序、编写测试以及用Opus 5.5修复一个由Grok 4.7引入的bug,就消耗了约21%的月度配额

Unverified50%
Oct 5

马斯克的Grok 4.7未按预期发布,疑似推迟

Unverified50%
Oct 4

Zed 将 Grok 4.7 加入 SuperGrok 与 xAI 提供商,并设为推荐默认模型

Unverified70%
Oct 3

Argon在CWE Bench上以68%与GPT-6 Astra、Grok 4.7并列第一

Unverified50%

40 more timeline events

All Facts (20)

Verified

Grok 4.5来自xAI,定位高端

75%
Verified

在DeepSuite基准上Grok 4.7得71%,GPT 5.6 Sol为72.7%,Fable 5.1为70%,Astra Max以74.1%登顶

65%
Verified

在 Terminal Bench 4.0 上,Opus 5.5 得分 66.4%,Astra 为 57.9%,Fable 5.1 为 55.8%,前代 Opus 5 为 52.3%

65%
Verified

xAI 的 Grok 4.5 已正式上线可用

80%
Unverified

Zed 将 Grok 4.7 加入 SuperGrok 与 xAI 提供商,并设为推荐默认模型

70%
Unverified

Grok 4.7 是在 Grok 4 系列基础上的小版本迭代,而非架构层面的大改

70%
Unverified

据 YouTube 频道实测分析,Grok 4.7 在多项基准测试中得分低于前代 Grok 4.6

60%
Unverified

创作者称Grok 4.6是他见过的远远最好的编程模型

60%
Unverified

Grok 4.6的核心焦点是代码能力与知识工作(knowledge work)

60%
Unverified

在一项voxel bench体素基准类创意生成测试中,疑似Grok 4.7检查点的神秘模型在氛围营造、色彩渐变与创意表达等方面超越了Grok 4.6甚至Kimi K3

50%
Unverified

据传Grok 4.7的参数规模约为2.1万亿

50%
Unverified

在作者实测中,相同任务Haiku 5.5约20秒完成,Grok 4.7耗时约35分钟,成本约为后者五分之一

50%
Unverified

在World of AI基准平台上Haiku 5.5综合排名第10,超越Grok 4.7

50%
Unverified

Argon在CWE Bench上以68%与GPT-6 Astra、Grok 4.7并列第一

50%
Unverified

Grok 4.7在企业文档解析任务上触及前沿水平

50%
Unverified

Databricks官方未给出GPT-6.1 Sol与Grok 4.7的完整基准成绩与技术细节数据

50%
Unverified

在改进T3 code的测试中,6.1 Sol得87.4分(Astra 83.8,Grok 4.7 80.7),成本仅2.15美元,而Opus 5.5需5美元、Sonnet 5.5近9美元

50%
Unverified

在T3代码改进任务中,GPT-6.1 Sol以87.4分击败Astra(83.8)和Grok 4.7(80.7),成本仅2.15美元

50%
Unverified

Grok 4.7 在两组测试中都表现偏弱,尤其网页部分效果较差

50%
Unverified

Artificial Analysis发布Cyber Index基准衡量AI模型网络防御能力,Grok 4.7与MIMO V2.6 Pro以56分并列最高

50%

Source Articles