Unverified50% confidenceBenchmarkExact time
在BrowseComp-Plus基准上,CLM配合Qwen3 27B取得59.4%,比最好的摘要方案高约11%,计算量少约五分之一
1
Sources
50%
Confidence
Long-term
Relevance
10/5/2026
First Seen
Sources
Related Entities
Related Claims
Unverified经验内化微调把Qwen3-8B-27B的一次性得分从37.07提升到48.22,同时生成Token从641万降到57万(减少11倍)67% similarUnverifiedQwen3.7 Max的输出质量高度依赖提示词质量,同一模型在不同提示词下的性能差异可高达30%-50%66% similarVerified测评者认为Qwen3.8 27B在编码能力上几乎所有方面都比上一代Qwen3.7更强65% similarUnverified微调后的Qwen3.5-4B模型在BU Bench V1基准上准确率从15%提升至53%65% similarUnverifiedQwen2.5-Max-0902最大输出为13万Token,推理模式下上限可达26万Token64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/979095API
curl https://kongchang.com/api/v1/knowledge/claims/979095MCP
get_claim(id=979095)