[KongchangAI]
Model千问 / Qwen3 / Qwen系列

Qwen

Qwen(通义千问)是阿里巴巴集团研发并开源的大语言模型系列,支持文本生成、对话、代码编写、多语言理解等多种自然语言处理任务。该系列涵盖不同参数规模的基础模型与对话微调版本,具备较强的中英文双语能力,可供研究人员和开发者进行下游任务微调与部署应用。

Core Facts

Timeline (last 90 days)

Sep 18

Dify 可在「模型供应商」设置中填入 Ollama 地址,即可调用本地运行的 DeepSeek、Llama、Qwen 等开源模型

Unverified50%
Sep 18

在两个Qwen模型上测试多token场景时,逐位打分并不能复现单token时观察到的正向关联

Unverified50%
Sep 18

Qwen系列模型和Llama-3.2-3B都能通过该方法暴露出人类可感知的风格轴

Unverified50%
Sep 18

Qwen(通义千问)是被广泛使用的开源大模型系列之一,以多语言能力和较好的性价比著称

Unverified50%
Sep 18

评估此类量化项目实用性应查阅项目仓库获取量化方法与基准测试、在自己硬件上实测并对比原版Qwen 27B输出质量

Unverified50%
Sep 17

Qwen系列由阿里巴巴达摩院研发,自2023年起持续在Hugging Face等平台开放权重

Unverified50%
Sep 17

将图像生成纳入开源计划是Qwen首次在生成式视觉方向全面开放

Unverified50%
Sep 17

阿里巴巴通义千问(Qwen)团队通过官方 X 账号确认,其图像生成模型 Qwen-Image 2.1 将走向开源

Unverified50%
Sep 17

在六个Qwen系列模型上进行匹配帧数(matched-frame)的对照实验,字幕方案在帧数对齐条件下平均准确率提升3.22分和2.55分

Unverified50%
Sep 16

私有化部署的技术路径分两类:将开源模型(如LLaMA、Qwen、DeepSeek)借助vLLM、Ollama、TGI等推理框架部署在自有服务器,或购买商业模型的私有化授权版本

Unverified50%

40 more timeline events

All Facts (20)

Verified

GPT-4和Mixtral等主流大模型也采用了MoE架构

85%
Verified

千问(Qwen)系列是阿里云通义实验室开发的开源大语言模型家族

80%
Verified

Meta于2023年发布LLaMA系列模型,随后Mistral、Qwen、DeepSeek等相继跟进形成开源生态

70%
Verified

Qwen(通义千问)是阿里巴巴开源的模型,在中文任务上表现优异

70%
Verified

Meta开源了Llama系列模型,阿里开源了Qwen系列,Mistral AI也采用开源策略

70%
Verified

Ollama是一个轻量级跨平台工具,专门用于本地大模型的部署和运行,支持Llama 3.1、Qwen2等开源模型

70%
Verified

当前开源大模型领域形成多极竞争格局,包括Meta的Llama、阿里巴巴的Qwen、Mistral AI和DeepSeek

65%
Verified

Qwen系列在架构层面引入了GQA(分组查询注意力)机制,相比标准多头注意力降低了KV缓存的内存占用

65%
Verified

Qwen系列采用Apache 2.0协议开放,允许商业使用和二次修改

65%
Verified

Meta的Llama 3系列、Mistral、Qwen、DeepSeek等模型在多项基准测试上已接近甚至超越早期的GPT-4水平,且支持本地部署

65%
Verified

Qwen 3.5架构使用改进的Transformer变体,融合了分组查询注意力(GQA)和旋转位置编码(RoPE)等技术

65%
Verified

Qwen是阿里巴巴达摩院开发的大语言模型系列,于2023年首次发布

65%
Unverified

开源AI大模型阵营以Meta(Llama系列)、DeepSeek、Mistral、阿里(Qwen)等为代表

90%
Unverified

千问(Qwen)和DeepSeek都提供了基于MOE架构的版本

90%
Unverified

Open-source models such as Llama, Qwen, and DeepSeek have further compressed deployment costs

85%
Unverified

Qwen系列模型已开源多个版本(Qwen-7B到Qwen-72B),在多项国际基准测试中表现优异

80%
Unverified

千问(Qwen)系列模型在爱马仕Agent中基本正常运行

80%
Unverified

RTX 4090拥有24GB显存,在加载27B Q4模型后通常还有足够空间支持3-4万Token的上下文

75%
Unverified

2024-2025年间Llama 3、Qwen 2.5等开源模型在多项基准测试中已接近甚至匹敌闭源商业模型

75%
Unverified

Llama.cpp supports dozens of mainstream open-source model architectures including Qwen, Mistral, Phi, and Gemma

60%

Source Articles