Qwen
Qwen(通义千问)是阿里巴巴集团研发并开源的大语言模型系列,支持文本生成、对话、代码编写、多语言理解等多种自然语言处理任务。该系列涵盖不同参数规模的基础模型与对话微调版本,具备较强的中英文双语能力,可供研究人员和开发者进行下游任务微调与部署应用。
Core Facts
Timeline (last 90 days)
Qwen-7B、LLaMA-2-7B等开源模型经过Agent Tuning后在工具调用准确率上可以达到GPT-3.5甚至接近GPT-4的水平
Qwen系列模型支持8K到128K不等的上下文窗口
Meta的LLaMA系列、Mistral AI的Mistral/Mixtral系列、阿里的Qwen系列、DeepSeek系列等都提供了从1B到数百B不等参数规模的开源版本
Llama 3.1和Qwen2.5的开源许可证允许商用
Ollama支持的模型包括Meta的Llama系列、Google的Gemma、阿里的通义千问等主流开源模型
Z-Image使用千问(Qwen)底层的CLIP类型作为文本编码器
开源AI大模型阵营以Meta(Llama系列)、DeepSeek、Mistral、阿里(Qwen)等为代表
OpenRouter提供免费的Qwen3 API服务
Qwen3-235B在基准测试中超过了Grok 3 Beta、Gemini 2.5 Pro、OpenAI的o3-mini和o1模型
Qwen3系列还上线了从0.6B到32B的六款稠密模型,全部基于Apache 2.0许可证发布
40 more timeline events
All Facts (10)
千问(Qwen)和DeepSeek都提供了基于MOE架构的版本
90%Unverified开源AI大模型阵营以Meta(Llama系列)、DeepSeek、Mistral、阿里(Qwen)等为代表
90%UnverifiedZ-Image使用千问(Qwen)底层的CLIP类型作为文本编码器
85%UnverifiedQwen系列模型支持8K到128K不等的上下文窗口
80%Unverified千问(Qwen)系列模型在爱马仕Agent中基本正常运行
80%UnverifiedQwen系列模型已开源多个版本(Qwen-7B到Qwen-72B),在多项国际基准测试中表现优异
80%UnverifiedMeta的LLaMA系列、Mistral、Qwen等开源模型的性能已接近甚至在特定任务上超越早期闭源模型
75%VerifiedQwen(通义千问)是阿里巴巴开源的模型,在中文任务上表现优异
65%VerifiedOllama支持的模型包括Meta的Llama系列、Google的Gemma、阿里的通义千问等主流开源模型
65%VerifiedMeta的LLaMA系列、Mistral AI的Mistral/Mixtral系列、阿里的Qwen系列、DeepSeek系列等都提供了从1B到数百B不等参数规模的开源版本
65%