DeepSeek
DeepSeek是由深度求索公司开发的大语言模型系列,具备自然语言理解与生成、代码编写、逻辑推理等核心能力。该系列模型以高性能与高效率为主要特征,支持多种自然语言处理任务,包括对话、问答、文本摘要及复杂推理,面向研究与商业应用场景提供开放或闭源版本。
Core Facts
Timeline (last 90 days)
Hermes Agent部署时DeepSeek的deepseek-chat模型即V3 Pro
Trae支持通过配置第三方API(如DeepSeek)来扩展AI能力
DeepSeek的API服务器部署在国内,国内用户访问延迟通常在50-200ms之间
阿里云百炼平台集成了阿里自研的通义千问(Qwen)系列模型以及第三方开源模型如DeepSeek、Llama等
DeepSeek V4选择不使用N-gram技术,放弃了此前在V3/R1中探索过的Multi-token Prediction结合N-gram的方案
DeepSeek V4的核心创新包括对MoE(混合专家)架构的持续优化和对训练流水线的深度工程调优
Meta的LLaMA系列、Mistral AI的Mistral/Mixtral系列、阿里的Qwen系列、DeepSeek系列等都提供了从1B到数百B不等参数规模的开源版本
DeepSeek R1默认不支持Function Calling,而DeepSeek V3支持Function Calling
DeepSeek可以将ASR启动脚本从倒计时模式改写为基于输出判断的智能启动逻辑
GPT-4、Claude 3.5、DeepSeek-V3等新一代模型的指令跟随能力和上下文理解能力大幅提升,使复杂提示词模板变得不再必要
40 more timeline events
All Facts (20)
DeepSeek的母公司是幻方量化,幻方量化是中国头部量化对冲基金之一
95%Unverified项目建立了多个专项审查智能体可并发执行,包括架构防火墙审查、全局编码风格审查、GAS专项审查和核心业务逻辑审查
90%UnverifiedB站UP主「花师小哲」对Manus在DeepSeek技术路线下的实际表现进行了案例实测
90%UnverifiedLangChain已集成DeepSeek、通义千问、GPT、Claude等主流聊天大模型
90%Unverified开源AI大模型阵营以Meta(Llama系列)、DeepSeek、Mistral、阿里(Qwen)等为代表
90%VerifiedDeepSeek的API定价远低于GPT-4等模型
90%UnverifiedOpenClaw v2026.5.14 新增专门的 DeepSeek V4 Flash Provider 配置页面,包含本地配置指南
90%VerifiedGRPO(Group Relative Policy Optimization)由DeepSeek提出,无需单独训练价值网络,已成为当前智能体RL训练的主流算法选择
90%Unverified千问(Qwen)和DeepSeek都提供了基于MOE架构的版本
90%UnverifiedB站UP主小刚分享了一套基于DeepSeek多Agent矩阵与UE5.8官方MCP协同开发虚幻引擎项目的完整工作流
90%VerifiedDeepSeek-V4-Pro是DeepSeek推出的最新旗舰级大语言模型
90%VerifiedDeepSeek是由中国人工智能公司深度求索开发的大语言模型系列
90%VerifiedDeepSeek V4 Pro相比前代在长上下文处理、代码分析和工具调用能力上有显著提升
90%UnverifiedObsidian的Copilot插件可在插件市场中搜索安装,支持配置Gemini、OpenAI、DeepSeek等多个模型
85%Unverified火山引擎方舟平台支持调用豆包、DeepSeek、智谱GLM、MiniMax、Moonshot(Kimi)等多家模型
85%UnverifiedCoze平台中的DeepSeek模型经过Coze团队优化,并非原版直接接入
85%Unverified创作者使用DeepSeek获取部署教程来完成网站上线
85%UnverifiedHermes Agent支持DeepSeek直连
85%Unverified豆包和DeepSeek等通用AI工具未接入知网数据库,生成的参考文献可能是虚构的
85%Unverified正确使用AI写论文的方法是先从知网获取真实文献,再让AI辅助生成大纲框架而非全文,最后用自己的语言组织论述
85%