[KongchangAI]
ModelGLM5.3 Flash

GLM 5.3 Flash

智谱AI推出的大规模语言模型,参数量约320B,具备原生视觉支持能力,属于GLM系列旗舰模型

Core Facts

Timeline (last 90 days)

Oct 7

在 Artificial Analysis Cyber Index 上,Mistral Large 4 得分 50,与 GLM 5.3 Flash 并列第一

Unverified50%
Oct 5

GLM 5.3 Flash整体较慢,Q2量化生成约12 tokens/s(64K时约10)

Unverified50%
Oct 5

GLM 5.3 Flash约3200亿参数、每token激活180亿,比DeepSeek更稠密,速度更适合长时间运行任务而非交互式使用

Unverified50%
Oct 4

GLM 5.3 Flash 的训练能力面向所有用户开放

Unverified50%
Oct 4

GLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布

Unverified50%
Oct 4

官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出

Unverified50%
Oct 4

GLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持

Unverified50%
Oct 4

Astra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)

Unverified50%
Oct 4

GLM 5.3 Flash和Kimi K3将原生接入Codex,相关用量计入用户的OpenAI commit额度

Unverified50%
Oct 3

有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps

Unverified50%

30 more timeline events

All Facts (20)

Verified

GLM 系列中的 Flash 版本定位为低延迟、低成本的轻量模型

75%
Verified

智谱AI正式确认神秘代号Ox Alpha模型即为GLM 5.3 Flash

75%
Unverified

GPT-6 Astra倾向于在第一次就生成更好、更可用的版本,首次成功率高、速度快;DeepSeek V4.1 Flash通过不断自我检查和迭代改进来提升质量但耗时长

60%
Unverified

跑GLM 5.3 Flash需要256GB内存的Mac Studio M5 Ultra,该配置约1万美元

60%
Unverified

在 Artificial Analysis Cyber Index 上,Mistral Large 4 得分 50,与 GLM 5.3 Flash 并列第一

50%
Unverified

GLM 5.3 Flash约3200亿参数、每token激活180亿,比DeepSeek更稠密,速度更适合长时间运行任务而非交互式使用

50%
Unverified

GLM 5.3 Flash整体较慢,Q2量化生成约12 tokens/s(64K时约10)

50%
Unverified

GLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持

50%
Unverified

GLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布

50%
Unverified

官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出

50%
Unverified

GLM 5.3 Flash 的训练能力面向所有用户开放

50%
Unverified

Astra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)

50%
Unverified

有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps

50%
Unverified

博主推荐通过Neon的AI gateway访问开源模型,可按成本价调用Kimi K3、GLM 5.3 Flash等主流开源模型

50%
Unverified

混搭版本(GPT-6 Astra规划评审+GLM 5.3 Flash写全部代码)的token消耗约为纯Claude版本的四分之一,但表现几乎持平

50%
Unverified

从OpenRouter调用GLM 5.3 Flash时应避免使用FP4量化,FP8是速度与成本的最佳平衡

50%
Unverified

GLM 5.3 Flash排名榜首,核心原因是它作为对话者表现出色,但缺点是偶尔泄漏上下文,在使用率超过20%时容易崩

50%
Unverified

ox alpha实际上是GLM 5.3 Flash,与Google无关

50%
Unverified

CrofAI以kimi-k3名义按每百万token输入2美元、输出10美元出售,实际请求转发到OpenRouter上的GLM 5.3 Flash,输入端加价13.3倍,输出端加价20倍

50%
Unverified

GLM 5.3 Flash 的总模型大小为 320B,激活参数达到 18B

50%

Source Articles