待验证50% 置信基准精确时间
腾讯官方自测数据宣称混元3几乎在每个领域都超过DeepSeek-V4-Pro,仅MCP相关测试项略逊
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/10
首次发现
有效期至:2026/10/8
来源
腾讯混元3开源:295B MoE架构全解析,256K上下文成最大短板
bilibili鲲鹏Talk2026/7/6
相关事实
待验证Phi-3-mini(3.8B参数)在部分基准测试上超越了Mixtral 8x7B等更大的混合专家模型66% 相似待验证Kimi K3的2.8万亿参数规模超越了此前最大的开放权重模型DeepSeek-V3的6710亿参数65% 相似待验证GLM-4.7在代码能力基准测试中超过DeepSeek V3.2及Claude Sonnet 4.565% 相似待验证Qwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几65% 相似待验证DeepSeek-V3发布时在多项基准测试中与Claude 3.5 Sonnet持平甚至超越,训练成本据报道仅为主流闭源模型的数分之一64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/465611API
curl https://kongchang.com/api/v1/knowledge/claims/465611MCP
get_claim(id=465611)