Unverified50% confidenceBenchmarkExact time
Qwen模型在HumanEval、MBPP等编程基准测试,以及GSM8K等数学推理测试中持续刷新记录,成为开源模型中的性能标杆
1
Sources
50%
Confidence
Short-term (~14 days)
Relevance
9/9/2026
First Seen
Valid until: 9/23/2026
Sources
Related Entities
Related Claims
Unverified过程奖励模型(PRM)在GSM8K等数学推理基准测试中显著提升了模型的推理准确率70% similarUnverifiedQwen(通义千问)在开源大模型领域多个尺寸的模型在各类评测榜单上名列前茅,尤其在中文能力和代码生成方面广受认可70% similarUnverified千问(Qwen)系列模型在训练数据中包含大量高质量代码语料,并针对代码生成、补全和Bug修复进行了专门的指令微调69% similarUnverifiedQwen模型可以通过LM Studio部署并用于本地推理68% similarUnverified大量国产模型以通义千问(Qwen)等开源模型为基座,在此基础上完成预训练和微调后对外发布68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/881624API
curl https://kongchang.com/api/v1/knowledge/claims/881624MCP
get_claim(id=881624)