Unverified80% confidenceOpinionTime unknown
测试者认为Claude Haiku 4.5在3D建模理解、代码性能优化、库引用准确性、物理逻辑推理、指令遵循能力五个维度均表现为差或极差
1
Sources
80%
Confidence
Medium-term (~90 days)
Relevance
6/3/2026
First Seen
Valid until: 9/1/2026
Sources
Claude Haiku 4.5实测:5项编程任务全面翻车
bilibilikarminski-牙医
Related Entities
Related Claims
UnverifiedB站UP主通过5项可视化编程任务对Claude Haiku 4.5进行了系统性测试,结果全部表现不佳81% similarUnverifiedClaude Haiku 4.5生成的大象牙膏动画代码存在严重性能瓶颈,运行时特别卡顿68% similarUnverifiedClaude 4.5 Haiku的设计目标是将推理延迟压缩到亚秒级别,同时将每次调用的token成本降至大型模型的几分之一67% similarUnverified量化并非无损压缩,精度越低模型推理质量(困惑度、逻辑推理能力)会有不同程度下降,4-bit量化被认为是质量与体积的较好平衡点65% similarUnverifiedHaiku 4.5在安全评估中的错位行为(misalignment behavior)发生率在所有模型中最低。65% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/40310API
curl https://kongchang.com/api/v1/knowledge/claims/40310MCP
get_claim(id=40310)