已验证80% 置信事实精确时间
MLA(多头潜在注意力)由DeepSeek团队在DeepSeek-V2中首次提出,通过将Key-Value对压缩到低维潜在空间大幅降低KV Cache显存占用
4
来源数
80%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Kimi K2.7 Code深度解析:万亿参数编程模型的性价比之战
bilibiliAI睡前简报2026/6/13
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/42606API
curl https://kongchang.com/api/v1/knowledge/claims/42606MCP
get_claim(id=42606)