Qwen
Qwen(通义千问)是阿里巴巴集团研发并开源的大语言模型系列,支持文本生成、对话、代码编写、多语言理解等多种自然语言处理任务。该系列涵盖不同参数规模的基础模型与对话微调版本,具备较强的中英文双语能力,可供研究人员和开发者进行下游任务微调与部署应用。
Core Facts
Timeline (last 90 days)
Dify 可在「模型供应商」设置中填入 Ollama 地址,即可调用本地运行的 DeepSeek、Llama、Qwen 等开源模型
在两个Qwen模型上测试多token场景时,逐位打分并不能复现单token时观察到的正向关联
Qwen系列模型和Llama-3.2-3B都能通过该方法暴露出人类可感知的风格轴
Qwen(通义千问)是被广泛使用的开源大模型系列之一,以多语言能力和较好的性价比著称
评估此类量化项目实用性应查阅项目仓库获取量化方法与基准测试、在自己硬件上实测并对比原版Qwen 27B输出质量
Qwen系列由阿里巴巴达摩院研发,自2023年起持续在Hugging Face等平台开放权重
将图像生成纳入开源计划是Qwen首次在生成式视觉方向全面开放
阿里巴巴通义千问(Qwen)团队通过官方 X 账号确认,其图像生成模型 Qwen-Image 2.1 将走向开源
在六个Qwen系列模型上进行匹配帧数(matched-frame)的对照实验,字幕方案在帧数对齐条件下平均准确率提升3.22分和2.55分
私有化部署的技术路径分两类:将开源模型(如LLaMA、Qwen、DeepSeek)借助vLLM、Ollama、TGI等推理框架部署在自有服务器,或购买商业模型的私有化授权版本
40 more timeline events
All Facts (20)
GPT-4和Mixtral等主流大模型也采用了MoE架构
85%Verified千问(Qwen)系列是阿里云通义实验室开发的开源大语言模型家族
80%VerifiedMeta于2023年发布LLaMA系列模型,随后Mistral、Qwen、DeepSeek等相继跟进形成开源生态
70%VerifiedQwen(通义千问)是阿里巴巴开源的模型,在中文任务上表现优异
70%VerifiedMeta开源了Llama系列模型,阿里开源了Qwen系列,Mistral AI也采用开源策略
70%VerifiedOllama是一个轻量级跨平台工具,专门用于本地大模型的部署和运行,支持Llama 3.1、Qwen2等开源模型
70%Verified当前开源大模型领域形成多极竞争格局,包括Meta的Llama、阿里巴巴的Qwen、Mistral AI和DeepSeek
65%VerifiedQwen系列在架构层面引入了GQA(分组查询注意力)机制,相比标准多头注意力降低了KV缓存的内存占用
65%VerifiedQwen系列采用Apache 2.0协议开放,允许商业使用和二次修改
65%VerifiedMeta的Llama 3系列、Mistral、Qwen、DeepSeek等模型在多项基准测试上已接近甚至超越早期的GPT-4水平,且支持本地部署
65%VerifiedQwen 3.5架构使用改进的Transformer变体,融合了分组查询注意力(GQA)和旋转位置编码(RoPE)等技术
65%VerifiedQwen是阿里巴巴达摩院开发的大语言模型系列,于2023年首次发布
65%Unverified开源AI大模型阵营以Meta(Llama系列)、DeepSeek、Mistral、阿里(Qwen)等为代表
90%Unverified千问(Qwen)和DeepSeek都提供了基于MOE架构的版本
90%UnverifiedOpen-source models such as Llama, Qwen, and DeepSeek have further compressed deployment costs
85%UnverifiedQwen系列模型已开源多个版本(Qwen-7B到Qwen-72B),在多项国际基准测试中表现优异
80%Unverified千问(Qwen)系列模型在爱马仕Agent中基本正常运行
80%UnverifiedRTX 4090拥有24GB显存,在加载27B Q4模型后通常还有足够空间支持3-4万Token的上下文
75%Unverified2024-2025年间Llama 3、Qwen 2.5等开源模型在多项基准测试中已接近甚至匹敌闭源商业模型
75%UnverifiedLlama.cpp supports dozens of mainstream open-source model architectures including Qwen, Mistral, Phi, and Gemma
60%