Unverified80% confidenceFactTime unknown
在空瓶换饮料数学推理题中,GPT-OSS 120B正确给出答案2700毫升,而GPT-OSS 20B两次尝试均未能给出解答
1
Sources
80%
Confidence
Medium-term (~90 days)
Relevance
6/1/2026
First Seen
Valid until: 8/30/2026
Sources
GPT-OSS 120B/20B开源模型深度测评:幻觉、推理、代码全面实测
bilibiliAI超元域
Related Entities
Related Claims
UnverifiedOpus 4.7每次解题的中位输出token数为60,000,而GPT 5.5仅需16,00060% similarUnverified最小精度为1g,对需要称量茶叶、香料、烘焙小克数配料(如酵母、泡打粉)的用户精度不够,建议选0.1g精度的秤58% similarUnverifiedBERT的参数规模为3.4亿,GPT-3的参数规模为1750亿56% similarUnverified千问三235B MoE总参数量2350亿,但每次推理实际激活的参数约22B56% similarUnverifiedBrown等人2020年的GPT-3论文发现仅通过改变提示格式,同一模型在标准基准测试上的表现可相差30%以上56% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/23226API
curl https://kongchang.com/api/v1/knowledge/claims/23226MCP
get_claim(id=23226)