DeepSeek
DeepSeek是由深度求索公司开发的大语言模型系列,具备自然语言理解与生成、代码编写、逻辑推理等核心能力。该系列模型以高性能与高效率为主要特征,支持多种自然语言处理任务,包括对话、问答、文本摘要及复杂推理,面向研究与商业应用场景提供开放或闭源版本。
Core Facts
Timeline (last 90 days)
一个开源项目通过DSL(领域特定语言)方式将AI链接助手迁入WPS,并支持接入DeepSeek等主流模型
DeepSeek内核工程师编写了DeepSeek V4.1 Flash的核心注意力内核
作者选择留在DeepSeek的原因是研究强大、快速、普惠且开源的AI
该项目的文本对话演示中使用了 DeepSeek 模型,语音回复集成了阿里云和智谱的 TTS 服务
构建能调用工具的 Agent 需要选择带锤子标识(支持工具调用)的模型,例如 OpenAI、月之暗面、DeepSeek
Dify 可在「模型供应商」设置中填入 Ollama 地址,即可调用本地运行的 DeepSeek、Llama、Qwen 等开源模型
可接入Dify的模型包括DeepSeek、ChatGPT等付费模型,以及百度文心一言、阿里通义千问等提供免费token的模型
通过Ollama部署的DeepSeek开源大模型最大参数版本下载后可达400多G
DeepSeek的部分评论提出了与其中国背景相关的地缘政治和数据隐私担忧
一项研究分析了来自Google Play和苹果App Store的17,012条英文评论,覆盖ChatGPT、Gemini、Microsoft Copilot、Claude、DeepSeek和Perplexity六款主流GenAI应用
40 more timeline events
All Facts (20)
DeepSeek-V3采用了混合专家架构(MoE),总参数量达6710亿,但每次推理仅激活约370亿参数
90%VerifiedDeepSeek-V4-Pro是DeepSeek推出的最新旗舰级大语言模型
90%VerifiedOpenCode是一个开源的命令行配置型AI编码智能体工具,支持自定义模型和插件扩展
90%VerifiedAI行业正在从单纯追求模型能力转向又快又强的务实路线
90%VerifiedDeepSeek的深度思考模式本质上是链式推理(Chain-of-Thought)机制的增强实现
90%VerifiedDeepSeek是由中国人工智能公司深度求索开发的大语言模型系列
90%VerifiedGRPO(Group Relative Policy Optimization)由DeepSeek提出,无需单独训练价值网络,已成为当前智能体RL训练的主流算法选择
90%VerifiedGPT-4和Mixtral等主流大模型也采用了MoE架构
85%VerifiedDeepSeek Harness采用TypeScript编写
80%VerifiedAI赋能测试体系围绕Harness工程体系展开,目标是实现可约束、有序、高质量的AI辅助测试生产流程
80%VerifiedDeepSeek是由量化私募巨头幻方量化孵化的AI实验室
80%VerifiedDeepSeek的API平台地址为platform.deepseek.com
80%VerifiedDeepSeek API Key创建后只显示一次,之后无法再查看
80%VerifiedDeepSeek-R1是专注于推理能力的模型,通过强化学习训练具备链式思考能力
80%VerifiedDeepSeek 的缓存命中价格可低至常规价格的十分之一
80%VerifiedOpenAI 的 Chat Completions API 采用消息数组作为输入的格式已成为行业事实标准,Anthropic、Google Gemini、Mistral 等主流模型提供商都提供了兼容或类似的接口
80%VerifiedDeepSeek由深度求索公司开发
80%VerifiedDeepSeek是国产顶尖推理模型,擅长代码和数学任务
80%VerifiedDeepSeek在性价比方面目前表现突出
80%VerifiedClaude Code支持通过OpenAI兼容API格式接入任意大模型,国内用户可配置DeepSeek、通义千问Qwen、智谱GLM-4等模型使用
80%