待验证50% 置信事实精确时间
LFM2.5在模拟真实Agent场景的电信测试中提升了74个点,指令跟随IFEval达到91.8,数学推理Math500达到88.8
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
LFM2.5本地部署实测:8B参数碾压GPT-o3s的工具调用能力
bilibiliAGI_Ananas2026/6/1
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/49058API
curl https://kongchang.com/api/v1/knowledge/claims/49058MCP
get_claim(id=49058)