[控场AI]
模型GLM5.3 Flash

GLM 5.3 Flash

智谱AI推出的大规模语言模型,参数量约320B,具备原生视觉支持能力,属于GLM系列旗舰模型

核心事实

时间轴 (近 90 天)

10月4日

GLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布

待验证50%
10月4日

官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出

待验证50%
10月4日

GLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持

待验证50%
10月4日

GLM 5.3 Flash 的训练能力面向所有用户开放

待验证50%
10月4日

Astra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)

待验证50%
10月4日

GLM 5.3 Flash和Kimi K3将原生接入Codex,相关用量计入用户的OpenAI commit额度

待验证50%
10月3日

有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps

待验证50%
10月2日

Hacker News 上有一则题为《One month coding with GLM 5.3 Flash》的帖子,作者用一个月的时间将 GLM 5.3 Flash 作为主力编程助手使用

待验证50%
9月30日

智谱 GLM Coding Plan 双节活动延期至 10 月 7 日,期间 GLM 5.3 Flash 在部分场景免费无限用、Agent 额度翻倍

待验证50%
9月27日

GLM 系列中的 Flash 版本定位为低延迟、低成本的轻量模型

已验证75%

还有 27 条时间轴事件

全部知识事实 (20)

已验证

GLM 系列中的 Flash 版本定位为低延迟、低成本的轻量模型

75%
已验证

智谱AI正式确认神秘代号Ox Alpha模型即为GLM 5.3 Flash

75%
待验证

GPT-6 Astra倾向于在第一次就生成更好、更可用的版本,首次成功率高、速度快;DeepSeek V4.1 Flash通过不断自我检查和迭代改进来提升质量但耗时长

60%
待验证

跑GLM 5.3 Flash需要256GB内存的Mac Studio M5 Ultra,该配置约1万美元

60%
待验证

GLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布

50%
待验证

GLM 5.3 Flash 的训练能力面向所有用户开放

50%
待验证

GLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持

50%
待验证

官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出

50%
待验证

Astra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)

50%
待验证

有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps

50%
待验证

博主推荐通过Neon的AI gateway访问开源模型,可按成本价调用Kimi K3、GLM 5.3 Flash等主流开源模型

50%
待验证

混搭版本(GPT-6 Astra规划评审+GLM 5.3 Flash写全部代码)的token消耗约为纯Claude版本的四分之一,但表现几乎持平

50%
待验证

GLM 5.3 Flash排名榜首,核心原因是它作为对话者表现出色,但缺点是偶尔泄漏上下文,在使用率超过20%时容易崩

50%
待验证

从OpenRouter调用GLM 5.3 Flash时应避免使用FP4量化,FP8是速度与成本的最佳平衡

50%
待验证

ox alpha实际上是GLM 5.3 Flash,与Google无关

50%
待验证

CrofAI以kimi-k3名义按每百万token输入2美元、输出10美元出售,实际请求转发到OpenRouter上的GLM 5.3 Flash,输入端加价13.3倍,输出端加价20倍

50%
待验证

GLM 5.3 Flash 的总模型大小为 320B,激活参数达到 18B

50%
待验证

Theo使用GLM 5.3 Flash或Luna模型开专门线程审计所有PR并按行动难易度排序,并同时用两个不同模型跑同一审计任务交叉验证

50%
待验证

Qwen 3.8 Flash的参数量为180B,是GLM 5.3 Flash(320B)的一半

50%
待验证

针对4×DGX Spark用户推荐分层部署:监督者智能体TP4运行GLM 5.3 Flash,工作者智能体运行Qwen 27B,子智能体运行Qwen 3.6 35B

50%

来源文章