Unverified50% confidenceBenchmarkExact time
FastEmbed-rs所使用的量化模型在MTEB基准测试中相比全精度模型的性能下降通常控制在1-2%以内
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/27/2026
First Seen
Valid until: 11/25/2026
Sources
Related Entities
Related Claims
Unverified对于参数量大于30B的模型,4-bit量化造成的性能损失通常在基准测试中下降1-3%,但对小模型影响更显著74% similarUnverified探索性能上界实验发现现有验证粒度并非最优,理想情况下计算量(FLOPs)可减少75倍,同时准确率提升1.1%72% similarUnverified大模型的性能提升已经明显放缓,最近新版本的评分甚至不一定超越之前的模型,能力基本已定型71% similarUnverified研究表明,即使在 GSM8K 或 MATH 数据集上接近满分的模型,面对稍作变形或需要跨领域组合的问题时性能下降可达30-50个百分点69% similarUnverifiedL1向量路由在Top20高频意图上准确率能达到95%以上,比L2大模型仅差1.5个百分点,但延迟和成本均降低约30倍69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/809138API
curl https://kongchang.com/api/v1/knowledge/claims/809138MCP
get_claim(id=809138)