待验证70% 置信事实时间未知
Qwen3.7 Max在数学推理、逻辑分析等高智力强度任务上保持了领先地位
1
来源数
70%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
Qwen3.7 Max深度解读:1T参数MoE架构与智能体全框架兼容
bilibili人工智能AI大模型课程
涉及实体
相关事实
待验证Qwen3.7 Max在通用智能体能力评测中超越了Claude系列模型和前代Qwen3.678% 相似待验证Qwen 3 Max在数学难题、弓箭模拟游戏和长程智能体任务中均获得满分10分74% 相似待验证Qwen 3 Max在数学难题(有序对排列计数题,正确答案2460)中完全答对,与Claude、Kimi K3和GPT-5同一梯队74% 相似待验证Qwen 3.6's performance in general programming capability, development skills, multi-turn agent-enhanced capability, and agent task testing leads Qwen 3.5 in many aspects and approaches or exceeds Claude 4.5 Opus on certain metrics.72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/17545API
curl https://kongchang.com/api/v1/knowledge/claims/17545MCP
get_claim(id=17545)