GLM 5.3 Flash
智谱AI推出的大规模语言模型,参数量约320B,具备原生视觉支持能力,属于GLM系列旗舰模型
Core Facts
Timeline (last 90 days)
在 Artificial Analysis Cyber Index 上,Mistral Large 4 得分 50,与 GLM 5.3 Flash 并列第一
GLM 5.3 Flash整体较慢,Q2量化生成约12 tokens/s(64K时约10)
GLM 5.3 Flash约3200亿参数、每token激活180亿,比DeepSeek更稠密,速度更适合长时间运行任务而非交互式使用
GLM 5.3 Flash 的训练能力面向所有用户开放
GLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布
官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出
GLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持
Astra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)
GLM 5.3 Flash和Kimi K3将原生接入Codex,相关用量计入用户的OpenAI commit额度
有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps
30 more timeline events
All Facts (20)
GLM 系列中的 Flash 版本定位为低延迟、低成本的轻量模型
75%Verified智谱AI正式确认神秘代号Ox Alpha模型即为GLM 5.3 Flash
75%UnverifiedGPT-6 Astra倾向于在第一次就生成更好、更可用的版本,首次成功率高、速度快;DeepSeek V4.1 Flash通过不断自我检查和迭代改进来提升质量但耗时长
60%Unverified跑GLM 5.3 Flash需要256GB内存的Mac Studio M5 Ultra,该配置约1万美元
60%Unverified在 Artificial Analysis Cyber Index 上,Mistral Large 4 得分 50,与 GLM 5.3 Flash 并列第一
50%UnverifiedGLM 5.3 Flash约3200亿参数、每token激活180亿,比DeepSeek更稠密,速度更适合长时间运行任务而非交互式使用
50%UnverifiedGLM 5.3 Flash整体较慢,Q2量化生成约12 tokens/s(64K时约10)
50%UnverifiedGLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持
50%UnverifiedGLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布
50%Unverified官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出
50%UnverifiedGLM 5.3 Flash 的训练能力面向所有用户开放
50%UnverifiedAstra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)
50%Unverified有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps
50%Unverified博主推荐通过Neon的AI gateway访问开源模型,可按成本价调用Kimi K3、GLM 5.3 Flash等主流开源模型
50%Unverified混搭版本(GPT-6 Astra规划评审+GLM 5.3 Flash写全部代码)的token消耗约为纯Claude版本的四分之一,但表现几乎持平
50%Unverified从OpenRouter调用GLM 5.3 Flash时应避免使用FP4量化,FP8是速度与成本的最佳平衡
50%UnverifiedGLM 5.3 Flash排名榜首,核心原因是它作为对话者表现出色,但缺点是偶尔泄漏上下文,在使用率超过20%时容易崩
50%Unverifiedox alpha实际上是GLM 5.3 Flash,与Google无关
50%UnverifiedCrofAI以kimi-k3名义按每百万token输入2美元、输出10美元出售,实际请求转发到OpenRouter上的GLM 5.3 Flash,输入端加价13.3倍,输出端加价20倍
50%UnverifiedGLM 5.3 Flash 的总模型大小为 320B,激活参数达到 18B
50%