[控场AI]
模型DeepSeek-R1-Distill-Qwen-7B

DeepSeek-R1-Distill-Qwen-7B

DeepSeek基于R1推理模型蒸馏的7B参数语言模型,以Qwen架构为基础,专注于数学与推理能力,是DeepSeek开源模型系列中的轻量推理版本

时间轴 (近 90 天)

9月18日

使用Reflective Recovery,DeepSeek-R1-Distill-Qwen-7B在AIME 2025上准确率从30.0%提升至37.5%

待验证50%

全部知识事实 (1)

来源文章