模型DeepSeek-R1-Distill-Qwen-7B
DeepSeek-R1-Distill-Qwen-7B
DeepSeek基于R1推理模型蒸馏的7B参数语言模型,以Qwen架构为基础,专注于数学与推理能力,是DeepSeek开源模型系列中的轻量推理版本
时间轴 (近 90 天)
9月18日
使用Reflective Recovery,DeepSeek-R1-Distill-Qwen-7B在AIME 2025上准确率从30.0%提升至37.5%
待验证50%
DeepSeek基于R1推理模型蒸馏的7B参数语言模型,以Qwen架构为基础,专注于数学与推理能力,是DeepSeek开源模型系列中的轻量推理版本
使用Reflective Recovery,DeepSeek-R1-Distill-Qwen-7B在AIME 2025上准确率从30.0%提升至37.5%