[KongchangAI]
Unverified50% confidenceFactExact time

在事实性评估任务上模型评判者准确率仍显著低于人类专家,但在风格、连贯性等主观维度已接近人类评审员间一致性水平

1
Sources
50%
Confidence
Long-term
Relevance
7/14/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/510664
API
curl https://kongchang.com/api/v1/knowledge/claims/510664
MCP
get_claim(id=510664)