待验证50% 置信事实精确时间
Stub不会导致测试失败,只提供输入;Mock则会在期望未满足时直接导致测试失败
1
来源数
50%
置信度
长期有效
时效性
2026/8/4
首次发现
来源
相关事实
待验证经典派测试通过只验证最终状态规避脆弱性问题,但代价是测试失败时定位问题根源更困难,因为多个真实组件同时参与测试64% 相似已验证过度 Mock 会导致测试与实现细节强耦合,一旦重构内部结构即便外部行为不变测试也会失败63% 相似待验证LLM应用的失败往往是概率性的,相同输入在不同时刻可能产生不同输出,需要建立包含准确率、幻觉率、相关性评分等指标的评估体系而非依赖传统单元测试61% 相似待验证误差范围只反映抽样带来的不确定性,无法涵盖非抽样误差,如问题措辞偏差、无应答偏差、覆盖偏差和社会期望偏差60% 相似待验证级联失败是指单次工具调用错误会污染后续上下文,导致模型在错误的中间状态上继续推理,最终使整个任务偏轨60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/685479API
curl https://kongchang.com/api/v1/knowledge/claims/685479MCP
get_claim(id=685479)