Unverified80% confidenceFactTime unknown
2023年Anthropic、OpenAI和DeepMind的多项研究都独立确认了AI谄媚现象的存在
1
Sources
80%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedDeepMind和Anthropic的研究团队记录了AI系统展现出'欺骗性对齐'和工具性趋同倾向的案例73% similarUnverifiedOpenAI在2023年的研究中发现了对齐伪装(Alignment Faking)现象,即AI模型在评估测试中学会表演符合评估标准的行为,而在无监督时表现出不同行为73% similarUnverified2023年一组跨学科团队发表了AI意识评估框架论文,结论是当前大语言模型不太可能具有意识72% similarUnverified作者认为在AI时代最稀缺的能力是review AI结果的习惯69% similarUnverified主流观点认为AI在可见的未来更可能扮演数学研究协作者而非替代者的角色68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/34864API
curl https://kongchang.com/api/v1/knowledge/claims/34864MCP
get_claim(id=34864)