待验证50% 置信事实精确时间
参与测试的四款模型是QDAM 3.7 Plus、LongCat 2.0、DeepSeek Feast Pro和MiniMax Mi3
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/9
首次发现
有效期至:2026/10/7
来源
国产平价AI模型网文写作能力实测:四款模型横向对比
bilibili灵蟹SoloEnt2026/7/5
相关事实
待验证Meta的Llama 3.1支持405B参数,与Qwen2.5、DeepSeek-V3等开源模型在多项基准测试中已接近甚至超越部分闭源商业模型66% 相似待验证演示中使用的是MiniMax M3模型,而非市面上性能最强的模型,选型标准为够用、成本可靠65% 相似待验证Qwen2.5-3B-Instruct、Phi-3.5-mini(3.8B)和Llama-3.2-3B-Instruct是2024年末在小参数规模上综合表现最优的三款模型64% 相似待验证本次测试选取了五款AI模型:DeepSeek R1、Claude Sonnet 3.7、ChatGPT o3 Mini、Grok 3、通义千问2.5 Max,通过统一提示词让它们各自生成可运行的网页版贪吃蛇游戏64% 相似待验证阿里巴巴发布Qwen 3.6 MAX预览版,在SWE Bench Pro和Terminal Bench等编码测试中击败Claude 4.5 Opus和GLM 5.1,目前为闭源模型仅可通过阿里云API或Qwen Studio访问64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/329235API
curl https://kongchang.com/api/v1/knowledge/claims/329235MCP
get_claim(id=329235)