[KongchangAI]
ModelGrok4.6

Grok 4.6

xAI即将发布的新一代大模型,参数规模2万亿,相比1.5万亿参数的前代全面提升,同时保持接近Grok 4.5的推理速度与Token效率

Timeline (last 90 days)

Sep 5

在太空飞行测试和前哨站立体模型测试中,Grok 4.6凭借高价格效率和快速生成速度脱颖而出

Unverified50%
Sep 5

综合评测结论:Opus 5为质量标杆但成本时间最高,Grok 4.6速度性价比极致但稳定性差,Kimi K3成本控制最优,GPT-5.6在部分构图出色但整体一致性落后

Unverified50%
Sep 5

在神社村庄测试中,Kimi K3产出无明显缺陷的场景表现优于Grok,而Opus 5因过度设计几何体杂乱显得不够美观

Unverified50%
Sep 5

在越野卡车测试中Grok 4.6直接失败,未能产生可玩结果;在古庙测试中虽最便宜最快但未完成场景构建

Unverified50%
Sep 5

一项覆盖13个测试项目的横向评测对比了Kimi K3、Claude Opus 5、Grok 4.6和GPT-5.6 Sol(Max)四款模型的游戏开发能力

Unverified50%
Sep 5

Fable 5.1生成的场景帧率更高且构建更优化,而Grok 4.6的构建未经优化

Unverified50%
Sep 5

在Oasis体素立体透视测试中,Fable 5.1生成的建筑横幅会自然弯曲,而Grok 4.6生成的横幅呈笔直直线

Unverified50%
Sep 5

在 QA 环节 Grok 4.6 未能发现自己主菜单存在的光照问题

Unverified50%
Sep 4

Grok 4.6在DeepSuite评测中得分65.9分,排名第三,落后于GPT-5.6 Sol Max(73分)和Fable 5(70%)

Unverified50%
Sep 4

在相同图形保真度下,Fable 5.1 的帧率更高且构建更优化,而 Grok 4.6 的构建未经优化

Unverified50%

40 more timeline events

All Facts (20)

Unverified

在神社村庄测试中,Kimi K3产出无明显缺陷的场景表现优于Grok,而Opus 5因过度设计几何体杂乱显得不够美观

50%
Unverified

综合评测结论:Opus 5为质量标杆但成本时间最高,Grok 4.6速度性价比极致但稳定性差,Kimi K3成本控制最优,GPT-5.6在部分构图出色但整体一致性落后

50%
Unverified

在越野卡车测试中Grok 4.6直接失败,未能产生可玩结果;在古庙测试中虽最便宜最快但未完成场景构建

50%
Unverified

一项覆盖13个测试项目的横向评测对比了Kimi K3、Claude Opus 5、Grok 4.6和GPT-5.6 Sol(Max)四款模型的游戏开发能力

50%
Unverified

在太空飞行测试和前哨站立体模型测试中,Grok 4.6凭借高价格效率和快速生成速度脱颖而出

50%
Unverified

Fable 5.1生成的场景帧率更高且构建更优化,而Grok 4.6的构建未经优化

50%
Unverified

在Oasis体素立体透视测试中,Fable 5.1生成的建筑横幅会自然弯曲,而Grok 4.6生成的横幅呈笔直直线

50%
Unverified

在 QA 环节 Grok 4.6 未能发现自己主菜单存在的光照问题

50%
Unverified

Grok 4.6在DeepSuite评测中得分65.9分,排名第三,落后于GPT-5.6 Sol Max(73分)和Fable 5(70%)

50%
Unverified

在 Echo Game 主菜单测试中,没有任何模型能在一次生成中复刻出原版效果

50%
Unverified

在 The Last of Us 主菜单测试中,Grok 4.6 输出质量位列第二,优于 GPT-5.6 和 Kimi K3

50%
Unverified

在相同图形保真度下,Fable 5.1 的帧率更高且构建更优化,而 Grok 4.6 的构建未经优化

50%
Unverified

在 Oasis 体素立体透视测试中,Fable 5.1 生成的横幅会自然弯曲,而 Grok 4.6 生成的横幅呈笔直直线

50%
Unverified

Grok 4.6是基于Grok 4.5的迭代升级(dot upgrade),而非全新训练的模型

50%
Unverified

Grok 4.6的核心焦点是代码能力与知识工作(knowledge work)

50%
Unverified

Grok 4.6在Gemini平台支持文本与图像输入、推理能力、函数调用以及结构化输出,服务于多步骤智能体工作流

50%
Unverified

发帖用户表示Grok 4.6消耗额度快得多(eat limits much faster)

50%
Unverified

该用户表示Grok 4.6消耗额度比Grok 4.5快得多

50%
Unverified

xAI频繁出现High Load可能源于其推理算力供给尚未达到成熟厂商规模,当大量用户同时段调用时提供方API因并发超配额返回限流响应

50%
Unverified

对于亚太时区开发者,UTC 05:00-12:00(北京时间13:00-20:00)可能是使用Grok 4.6的相对低谷期

50%

Source Articles