[控场AI]
模型DeepSeek Pro / 深度求索 / DeepSeek公司

DeepSeek

DeepSeek是由深度求索公司开发的大语言模型系列,具备自然语言理解与生成、代码编写、逻辑推理等核心能力。该系列模型以高性能与高效率为主要特征,支持多种自然语言处理任务,包括对话、问答、文本摘要及复杂推理,面向研究与商业应用场景提供开放或闭源版本。

核心事实

时间轴 (近 90 天)

8月27日

DeepSeek的API Key创建后会被隐藏,必须在生成时立即复制保存

待验证50%
8月27日

Unsloth Desktop当前已支持Qwen3、Meta系列模型以及DeepSeek等多种主流模型

待验证50%
8月27日

DeepSeek在推出Harness的同时,API调用费用正式上涨,且涨幅不小

待验证50%
8月26日

DeepSeek 的 API 定价仅为 OpenAI 同级产品的数分之一

待验证50%
8月26日

火山方舟是字节跳动推出的模型集成平台,聚合了豆包以及DeepSeek等多种模型

待验证50%
8月26日

DeepSeek的前缀缓存实现基于MLA(Multi-head Latent Attention)架构,MLA通过低秩压缩将KV Cache的存储需求降低了数十倍

待验证50%
8月26日

DeepSeek自2023年成立以来,凭借V2的MoE架构创新和V3的超大规模训练跻身全球顶级模型行列

待验证50%
8月26日

中国的DeepSeek在2025年初以极低成本训练出性能媲美顶尖模型的作品,对西方实验室的大规模训练路线构成范式挑战

待验证50%
8月26日

Harness是DeepSeek官方提供的一套模型控制与工作流程系统,其技术定位类似于OpenAI的Codex CLI或Anthropic的Claude Code

待验证50%
8月25日

DeepSeek将实验性多模态模型V4-Flash-Vision-EXP上线API平台,其文本能力与V4 Flash持平

待验证50%

还有 40 条时间轴事件

全部知识事实 (20)

已验证

DeepSeek V4 Pro相比前代在长上下文处理、代码分析和工具调用能力上有显著提升

90%
已验证

DeepSeek-V4-Pro是DeepSeek推出的最新旗舰级大语言模型

90%
已验证

DeepSeek是由中国人工智能公司深度求索开发的大语言模型系列

90%
已验证

DeepSeek的API定价远低于GPT-4等模型

90%
已验证

GRPO(Group Relative Policy Optimization)由DeepSeek提出,无需单独训练价值网络,已成为当前智能体RL训练的主流算法选择

90%
已验证

DeepSeek Harness采用TypeScript编写

80%
已验证

DeepSeek是由量化私募巨头幻方量化孵化的AI实验室

80%
已验证

Dify支持数百个大语言模型,包括OpenAI、Gemini、Claude、智谱、百川、讯飞星火、通义千问、文心一言、DeepSeek等

80%
已验证

DeepSeek的API平台地址为platform.deepseek.com

80%
已验证

DeepSeek API Key创建后只显示一次,之后无法再查看

80%
已验证

DeepSeek-R1是专注于推理能力的模型,通过强化学习训练具备链式思考能力

80%
已验证

DeepSeek 的缓存命中价格可低至常规价格的十分之一

80%
已验证

DeepSeek由深度求索公司开发

80%
已验证

DeepSeek是国产顶尖推理模型,擅长代码和数学任务

80%
已验证

DeepSeek在性价比方面目前表现突出

80%
已验证

Claude Code支持通过OpenAI兼容API格式接入任意大模型,国内用户可配置DeepSeek、通义千问Qwen、智谱GLM-4等模型使用

80%
已验证

DeepSeek采用MOE(Mixture of Experts,混合专家)架构,每次推理时只激活部分专家子网络而非全部参数

80%
已验证

DeepSeek的深度思考模式本质上是链式推理(Chain-of-Thought)机制的增强实现

80%
已验证

DeepSeek的API定价是每百万Token输入0.14美元、输出0.28美元

80%
已验证

Claude Code原生支持第三方模型协议,用户可直接配置接入DeepSeek等第三方模型

80%

来源文章