待验证50% 置信事实精确时间
从自然语言提取待办事项的NLP评估指标通常包括精确率(Precision)和召回率(Recall)
1
来源数
50%
置信度
长期有效
时效性
2026/8/19
首次发现
来源
相关事实
待验证可溯源生成领域的评估标准包括归因精度(attribution precision)和归因召回率(attribution recall)71% 相似待验证指令遵循能力(Instruction Following)是NLP领域一个独立的评估维度,专门的评测基准包括IFEval、FollowBench64% 相似待验证LLM评估需同时考量事实准确性、指令遵循度、有害性、有用性和表达质量等多个维度,这些维度之间常存在张力64% 相似待验证评估(Evaluation)通过预定义的测试集和评分标准衡量输出质量,维度包括准确性、相关性、忠实度、有害内容检测64% 相似待验证AIGC检测通过分析文本的统计特征(如词汇多样性、句式结构、困惑度等指标)来判断内容是否由AI生成63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/774566API
curl https://kongchang.com/api/v1/knowledge/claims/774566MCP
get_claim(id=774566)