待验证50% 置信基准精确时间
在Perplexity的RAG场景中,单次用户查询可能触发20-50次模型调用
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/9
首次发现
有效期至:2026/12/8
来源
涉及实体
相关事实
待验证在RAG流程中,一个原本50个Token的用户问题可能膨胀为包含5000-10000个Token的完整Prompt77% 相似待验证超低输入价格对RAG场景有利,因为典型RAG查询可能注入5000-20000个token的检索结果而输出仅有200-500个token68% 相似待验证业界估计隐性token(系统提示词、RAG检索上下文、函数描述、对话历史)通常占据单次请求总消耗的60%-80%66% 相似待验证测试LLM引用行为时应对同一提示至少运行20—50次,理想情况下扩大至100次以上62% 相似待验证推理模型通过思维链或内部搜索进行多步推演,token消耗量可能是普通模型的5到20倍62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/884076API
curl https://kongchang.com/api/v1/knowledge/claims/884076MCP
get_claim(id=884076)