Unverified50% confidenceBenchmarkExact time
消融实验中移除搜索工具后Doubao Seed 2.0 Pro准确率从43.1%暴跌至2.4%,证明任务必须依赖外部检索
1
Sources
50%
Confidence
Long-term
Relevance
7/9/2026
First Seen
Sources
腾讯DiscoBench:评测LLM搜索代理歧义澄清能力的首个基准
bilibili熊二等兵7/4/2026
Related Claims
UnverifiedSeedance 2.0慢速版算力消耗为快速版的一半66% similarUnverified移除歧义后所有模型准确率提升26.8至40.2个百分点,Gemini甚至达到81%,表明歧义是深度搜索代理最大性能瓶颈之一65% similarUnverifiedGPT 5.2在前沿科学基准的竞赛题中得分约77%,但在开放式研究任务中表现下降到约25%62% similarUnverified研究表明在INT4/INT8精度下多数推理和生成任务的输出质量下降幅度在1-3%以内62% similarVerified研究表明在 Q4 及以上精度时,大多数任务的性能损失在 1–3% 以内61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/387241API
curl https://kongchang.com/api/v1/knowledge/claims/387241MCP
get_claim(id=387241)