待验证50% 置信事件时间未知
一位B站内容创作者对Claude Haiku 4.5进行了系统性的视觉编程任务测试
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Claude Haiku 4.5 Real-World Test: Failed All 5 Programming Tasks
bilibilikarminski-牙医
相关事实
待验证测试者建议涉及代码生成、逻辑推理、空间理解的场景应使用Claude Sonnet 3.5或更高级别的模型,而非Claude Haiku 4.568% 相似待验证Anthropic公开了Claude Haiku 4.5的详细系统卡(System Card),涵盖训练数据来源、提示工程策略以及基准测试结果68% 相似待验证在Pillow库RGB转HSV精度Bug测试中,Claude Code使用Sonnet 4.6模型一次通过,逻辑清晰,获得满分65% 相似待验证A Bilibili content creator named Jiuling conducted a head-to-head comparison test of five AI models for game development.65% 相似待验证A Bilibili content creator conducted hands-on testing of the DS4 project, covering frontend mini-games and STM32 embedded development scenarios.65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/54457API
curl https://kongchang.com/api/v1/knowledge/claims/54457MCP
get_claim(id=54457)