GLM 5.3 Flash
智谱AI推出的大规模语言模型,参数量约320B,具备原生视觉支持能力,属于GLM系列旗舰模型
核心事实
时间轴 (近 90 天)
GLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布
官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出
GLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持
GLM 5.3 Flash 的训练能力面向所有用户开放
Astra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)
GLM 5.3 Flash和Kimi K3将原生接入Codex,相关用量计入用户的OpenAI commit额度
有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps
Hacker News 上有一则题为《One month coding with GLM 5.3 Flash》的帖子,作者用一个月的时间将 GLM 5.3 Flash 作为主力编程助手使用
智谱 GLM Coding Plan 双节活动延期至 10 月 7 日,期间 GLM 5.3 Flash 在部分场景免费无限用、Agent 额度翻倍
GLM 系列中的 Flash 版本定位为低延迟、低成本的轻量模型
还有 27 条时间轴事件
全部知识事实 (20)
GLM 系列中的 Flash 版本定位为低延迟、低成本的轻量模型
75%已验证智谱AI正式确认神秘代号Ox Alpha模型即为GLM 5.3 Flash
75%待验证GPT-6 Astra倾向于在第一次就生成更好、更可用的版本,首次成功率高、速度快;DeepSeek V4.1 Flash通过不断自我检查和迭代改进来提升质量但耗时长
60%待验证跑GLM 5.3 Flash需要256GB内存的Mac Studio M5 Ultra,该配置约1万美元
60%待验证GLM 5.3 Flash 的具体基准测试数据、定价细节和训练参数限制尚未在该发布信息中公布
50%待验证GLM 5.3 Flash 的训练能力面向所有用户开放
50%待验证GLM 5.3 Flash 同时提供视觉(vision)与文本(text)两种模态的训练支持
50%待验证官方称 GLM 5.3 Flash 在智能体编程、文档分析和工具调用三类基准测试中表现突出
50%待验证Astra在Artificial Analysis智能指数上低于GLM 5.3 Flash等小模型,因该指数基于已过时饱和的基准(如GPQA)
50%待验证有用户提到在GLM 5.3 Flash上做编程相关任务可以跑到300 tps
50%待验证博主推荐通过Neon的AI gateway访问开源模型,可按成本价调用Kimi K3、GLM 5.3 Flash等主流开源模型
50%待验证混搭版本(GPT-6 Astra规划评审+GLM 5.3 Flash写全部代码)的token消耗约为纯Claude版本的四分之一,但表现几乎持平
50%待验证GLM 5.3 Flash排名榜首,核心原因是它作为对话者表现出色,但缺点是偶尔泄漏上下文,在使用率超过20%时容易崩
50%待验证从OpenRouter调用GLM 5.3 Flash时应避免使用FP4量化,FP8是速度与成本的最佳平衡
50%待验证ox alpha实际上是GLM 5.3 Flash,与Google无关
50%待验证CrofAI以kimi-k3名义按每百万token输入2美元、输出10美元出售,实际请求转发到OpenRouter上的GLM 5.3 Flash,输入端加价13.3倍,输出端加价20倍
50%待验证GLM 5.3 Flash 的总模型大小为 320B,激活参数达到 18B
50%待验证Theo使用GLM 5.3 Flash或Luna模型开专门线程审计所有PR并按行动难易度排序,并同时用两个不同模型跑同一审计任务交叉验证
50%待验证Qwen 3.8 Flash的参数量为180B,是GLM 5.3 Flash(320B)的一半
50%待验证针对4×DGX Spark用户推荐分层部署:监督者智能体TP4运行GLM 5.3 Flash,工作者智能体运行Qwen 27B,子智能体运行Qwen 3.6 35B
50%