Unverified50% confidenceFactExact time
参与测试的四款模型是QDAM 3.7 Plus、LongCat 2.0、DeepSeek Feast Pro和MiniMax Mi3
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/9/2026
First Seen
Valid until: 10/7/2026
Sources
国产平价AI模型网文写作能力实测:四款模型横向对比
bilibili灵蟹SoloEnt7/5/2026
Related Claims
UnverifiedMeta的Llama 3.1支持405B参数,与Qwen2.5、DeepSeek-V3等开源模型在多项基准测试中已接近甚至超越部分闭源商业模型66% similarUnverified演示中使用的是MiniMax M3模型,而非市面上性能最强的模型,选型标准为够用、成本可靠65% similarUnverifiedQwen2.5-3B-Instruct、Phi-3.5-mini(3.8B)和Llama-3.2-3B-Instruct是2024年末在小参数规模上综合表现最优的三款模型64% similarUnverified本次测试选取了五款AI模型:DeepSeek R1、Claude Sonnet 3.7、ChatGPT o3 Mini、Grok 3、通义千问2.5 Max,通过统一提示词让它们各自生成可运行的网页版贪吃蛇游戏64% similarUnverified阿里巴巴发布Qwen 3.6 MAX预览版,在SWE Bench Pro和Terminal Bench等编码测试中击败Claude 4.5 Opus和GLM 5.1,目前为闭源模型仅可通过阿里云API或Qwen Studio访问64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/329235API
curl https://kongchang.com/api/v1/knowledge/claims/329235MCP
get_claim(id=329235)