待验证50% 置信事实精确时间
DeepSpec配套九个评测基准,涵盖数学推理(GSM8K、MATH-500)、代码生成(HumanEval、MBPP、LiveCodeBench)和通用对话(MT-Bench、Alpaca、Arena-Hard v2)
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/25
首次发现
有效期至:2026/10/23
来源
相关事实
待验证DeepSpec集成三大主流Draft Model算法、九个Hugging Face预训练Checkpoint和九个评测基准75% 相似已验证DeepSeek在多项代码基准测试(如HumanEval、MBPP、LiveCodeBench)中表现优异,部分指标接近甚至超越GPT-4级别模型74% 相似待验证DeepSeek-Coder-V2 在 HumanEval 等代码评测榜上长期位居前列73% 相似待验证DeepSeek Coder以DeepSeek Math为底层基础,DeepSeek Math在MATH、GSM8K等数学基准上表现优异72% 相似待验证DeepSeek开源了推理加速工具包DSpec(亦称DeepSpec),内置其推测性解码技术(DSPI/MTP系列),包含模型代码、训练脚本和评估工具的完整GitHub仓库72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/615365API
curl https://kongchang.com/api/v1/knowledge/claims/615365MCP
get_claim(id=615365)