GLM
GLM(General Language Model)是由智谱AI研发的大语言模型系列,基于自回归空白填充的预训练框架构建。该系列模型支持自然语言理解、文本生成、对话交互、代码编写等多种任务,具备中英文双语处理能力。GLM系列涵盖不同规模的参数版本,可应用于问答、摘要、推理等多种自然语言处理场景。
Core Facts
Timeline (last 90 days)
Reflection称Beam在推理类测试上与GLM成绩相当,但推理算力省三到四倍,该倍数按激活参数和生成token数估算,非实测成本
发帖者认为如果循环架构能在工业规模稳定工作,DeepSeek、Qwen、GLM 等开源模型团队或许会开始实验这类架构
GLM模型尝试了50次通过pip下载它正在修复的那个库的已修复版本
系统支持智能体混合模式,可让 Kimi K3 与另一个开源模型(如 GLM 系列)并排协作共同处理同一任务
本期参赛的国产AI模型包括混元、GLM、DeepSeek和小米四款
DeepSeek、Qwen、GLM 同属中国团队主导的开源模型阵营
ChatGLM系列是GLM面向对话场景的落地版本
DigitalOcean 模型目录涵盖了 DeepSeek、Qwen(通义千问)、GLM 等主流开源模型
招商银行的训推一体平台底层主要由三种国产异构算力卡构成,承载千问、DeepSeek、GLM、MiniMax等不同参数规模的模型
Z.ai的GLM被接入Mistral提供商
40 more timeline events
All Facts (20)
@ai-sdk/zai 是 Vercel AI SDK 面向智谱 AI(Zhipu AI)模型的官方 Provider
90%VerifiedGLM 通过自回归空白填充(Autoregressive Blank Infilling)统一了自然语言理解与生成的预训练目标
90%VerifiedGLM系列最初采用自回归填空的预训练框架,兼顾理解与生成能力
90%Verified早期GLM采用了自回归填空(Autoregressive Blank Infilling)的预训练目标
90%VerifiedGLM系列由清华大学KEG实验室与智谱AI联合研发
90%Verified@ai-sdk/zai 依赖于 @ai-sdk/openai-compatible,说明智谱 GLM 的 API 接口在很大程度上兼容 OpenAI 的调用规范
85%VerifiedVLM(视觉语言模型)通常由视觉编码器(如ViT)、语言模型和连接两者的投影层组成,代表性模型包括GPT-4V/4o、Claude 3.5、LLaVA系列和InternVL
80%VerifiedGLM采用了独特的自回归填空预训练范式,与GPT的纯自回归和BERT的纯掩码语言模型都有所不同
80%VerifiedGLM系列是清华大学与智谱AI联合研发的大语言模型,基于自回归空白填充(Autoregressive Blank Infilling)训练目标构建
80%Verified智谱(Z.ai)的 GLM 系列模型由清华大学与智谱 AI 联合研发
75%Verified智谱AI是由清华大学KEG实验室技术成果转化成立的人工智能公司
75%VerifiedGLM采用自回归填空训练目标,通过对文本片段随机遮蔽并要求模型自回归还原
75%Verified智谱AI是清华大学技术成果转化企业,其GLM架构采用自回归空白填充的预训练目标
75%VerifiedDeepSeek Harness支持接入第三方Provider,可通过OpenCode Go接入GLM等模型,或连接本地Ollama服务
65%VerifiedChatGLM由智谱AI开发,基于GLM架构
65%Verified智谱GLM系列模型(包括GLM-4、ChatGLM等)是清华大学与智谱AI联合研发的大语言模型
65%Unverified智谱AI的GLM系列脱胎于清华大学计算机系的学术研究
90%UnverifiedGLM等国产模型在训练阶段增加了高质量中文语料比例,并在分词器设计上对中文字符进行优化
70%UnverifiedZCode是一款基于GLM模型的编程Agent,主打通过大模型辅助代码理解、生成与重构,能够读取项目上下文提供智能建议
60%Unverified主流大语言模型训练语料中,英文数据占据压倒性比例,以Common Crawl等公开数据集为例,英文内容通常占总量的40%-60%,而越南语、中文等语言的占比往往不足5%
60%