Unverified50% confidenceBenchmarkExact time
MUSA Coder 27B版本在KernelBench评测基准中表现超越Claude Opus等主流商业模型
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/10/2026
First Seen
Valid until: 10/8/2026
Sources
GLM-5.2即将发布?国产GPU代码大模型MUSA Coder正式开源
bilibili黑鸦Heya6/10/2026
Related Claims
Unverified在SWE-bench Pro基准上,千问3.8 27B模型的分数超过了Claude Opus62% similarUnverified千问3 Coder 30B在编程基准测试(如HumanEval、MBPP等)中的表现已接近甚至超过部分早期商业闭源模型62% similarUnverified从指令遵循维度看,27B本地模型比旗舰Opus表现更贴近用户原始意图,但这可能只是因为其推断能力边界更保守59% similarUnverifiedQwen3.6 27B在MMLU、HumanEval等主流基准测试中表现接近部分商业模型57% similarUnverified评测者认为通义千问3.6 27B是30B级别中对高考数学题表现最好的模型56% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/469238API
curl https://kongchang.com/api/v1/knowledge/claims/469238MCP
get_claim(id=469238)