DeepSeek
DeepSeek是由深度求索公司开发的大语言模型系列,具备自然语言理解与生成、代码编写、逻辑推理等核心能力。该系列模型以高性能与高效率为主要特征,支持多种自然语言处理任务,包括对话、问答、文本摘要及复杂推理,面向研究与商业应用场景提供开放或闭源版本。
核心事实
时间轴 (近 90 天)
DeepSeek的API Key创建后会被隐藏,必须在生成时立即复制保存
Unsloth Desktop当前已支持Qwen3、Meta系列模型以及DeepSeek等多种主流模型
DeepSeek在推出Harness的同时,API调用费用正式上涨,且涨幅不小
DeepSeek 的 API 定价仅为 OpenAI 同级产品的数分之一
火山方舟是字节跳动推出的模型集成平台,聚合了豆包以及DeepSeek等多种模型
DeepSeek的前缀缓存实现基于MLA(Multi-head Latent Attention)架构,MLA通过低秩压缩将KV Cache的存储需求降低了数十倍
DeepSeek自2023年成立以来,凭借V2的MoE架构创新和V3的超大规模训练跻身全球顶级模型行列
中国的DeepSeek在2025年初以极低成本训练出性能媲美顶尖模型的作品,对西方实验室的大规模训练路线构成范式挑战
Harness是DeepSeek官方提供的一套模型控制与工作流程系统,其技术定位类似于OpenAI的Codex CLI或Anthropic的Claude Code
DeepSeek将实验性多模态模型V4-Flash-Vision-EXP上线API平台,其文本能力与V4 Flash持平
还有 40 条时间轴事件
全部知识事实 (20)
DeepSeek V4 Pro相比前代在长上下文处理、代码分析和工具调用能力上有显著提升
90%已验证DeepSeek-V4-Pro是DeepSeek推出的最新旗舰级大语言模型
90%已验证DeepSeek是由中国人工智能公司深度求索开发的大语言模型系列
90%已验证DeepSeek的API定价远低于GPT-4等模型
90%已验证GRPO(Group Relative Policy Optimization)由DeepSeek提出,无需单独训练价值网络,已成为当前智能体RL训练的主流算法选择
90%已验证DeepSeek Harness采用TypeScript编写
80%已验证DeepSeek是由量化私募巨头幻方量化孵化的AI实验室
80%已验证Dify支持数百个大语言模型,包括OpenAI、Gemini、Claude、智谱、百川、讯飞星火、通义千问、文心一言、DeepSeek等
80%已验证DeepSeek的API平台地址为platform.deepseek.com
80%已验证DeepSeek API Key创建后只显示一次,之后无法再查看
80%已验证DeepSeek-R1是专注于推理能力的模型,通过强化学习训练具备链式思考能力
80%已验证DeepSeek 的缓存命中价格可低至常规价格的十分之一
80%已验证DeepSeek由深度求索公司开发
80%已验证DeepSeek是国产顶尖推理模型,擅长代码和数学任务
80%已验证DeepSeek在性价比方面目前表现突出
80%已验证Claude Code支持通过OpenAI兼容API格式接入任意大模型,国内用户可配置DeepSeek、通义千问Qwen、智谱GLM-4等模型使用
80%已验证DeepSeek采用MOE(Mixture of Experts,混合专家)架构,每次推理时只激活部分专家子网络而非全部参数
80%已验证DeepSeek的深度思考模式本质上是链式推理(Chain-of-Thought)机制的增强实现
80%已验证DeepSeek的API定价是每百万Token输入0.14美元、输出0.28美元
80%已验证Claude Code原生支持第三方模型协议,用户可直接配置接入DeepSeek等第三方模型
80%