DeepSeek是由深度求索公司开发的大语言模型系列,具备自然语言理解与生成、代码编写、逻辑推理等核心能力。该系列模型以高性能与高效率为主要特征,支持多种自然语言处理任务,包括对话、问答、文本摘要及复杂推理,面向研究与商业应用场景提供开放或闭源版本。
Unsloth Desktop当前已支持Qwen3、Meta系列模型以及DeepSeek等多种主流模型
DeepSeek在推出Harness的同时,API调用费用正式上涨,且涨幅不小
DeepSeek 的 API 定价仅为 OpenAI 同级产品的数分之一
火山方舟是字节跳动推出的模型集成平台,聚合了豆包以及DeepSeek等多种模型
DeepSeek的前缀缓存实现基于MLA(Multi-head Latent Attention)架构,MLA通过低秩压缩将KV Cache的存储需求降低了数十倍
DeepSeek自2023年成立以来,凭借V2的MoE架构创新和V3的超大规模训练跻身全球顶级模型行列
中国的DeepSeek在2025年初以极低成本训练出性能媲美顶尖模型的作品,对西方实验室的大规模训练路线构成范式挑战
Harness是DeepSeek官方提供的一套模型控制与工作流程系统,其技术定位类似于OpenAI的Codex CLI或Anthropic的Claude Code
DeepSeek将实验性多模态模型V4-Flash-Vision-EXP上线API平台,其文本能力与V4 Flash持平
RisenX是一个运行在终端中的DeepSeek原生编码智能体,直接与api.deepseek.com通信,没有OpenAI兼容适配器或代理层
40 more timeline events
DeepSeek V4 Pro相比前代在长上下文处理、代码分析和工具调用能力上有显著提升
90%VerifiedDeepSeek-V4-Pro是DeepSeek推出的最新旗舰级大语言模型
90%VerifiedDeepSeek是由中国人工智能公司深度求索开发的大语言模型系列
90%VerifiedDeepSeek的API定价远低于GPT-4等模型
90%VerifiedGRPO(Group Relative Policy Optimization)由DeepSeek提出,无需单独训练价值网络,已成为当前智能体RL训练的主流算法选择
90%VerifiedDeepSeek Harness采用TypeScript编写
80%VerifiedDeepSeek是由量化私募巨头幻方量化孵化的AI实验室
80%VerifiedDify支持数百个大语言模型,包括OpenAI、Gemini、Claude、智谱、百川、讯飞星火、通义千问、文心一言、DeepSeek等
80%VerifiedDeepSeek的API平台地址为platform.deepseek.com
80%VerifiedDeepSeek API Key创建后只显示一次,之后无法再查看
80%VerifiedDeepSeek-R1是专注于推理能力的模型,通过强化学习训练具备链式思考能力
80%VerifiedDeepSeek 的缓存命中价格可低至常规价格的十分之一
80%VerifiedDeepSeek由深度求索公司开发
80%VerifiedDeepSeek是国产顶尖推理模型,擅长代码和数学任务
80%VerifiedDeepSeek在性价比方面目前表现突出
80%VerifiedClaude Code支持通过OpenAI兼容API格式接入任意大模型,国内用户可配置DeepSeek、通义千问Qwen、智谱GLM-4等模型使用
80%VerifiedDeepSeek采用MOE(Mixture of Experts,混合专家)架构,每次推理时只激活部分专家子网络而非全部参数
80%VerifiedDeepSeek的深度思考模式本质上是链式推理(Chain-of-Thought)机制的增强实现
80%VerifiedDeepSeek的API定价是每百万Token输入0.14美元、输出0.28美元
80%VerifiedClaude Code原生支持第三方模型协议,用户可直接配置接入DeepSeek等第三方模型
80%