[控场AI]
模型DeepSeek V3 / DeepSeek V4 Pro / DeepSeek V4-Pro

DeepSeek V4

DeepSeek V4是由DeepSeek发布的大规模语言模型,采用混合专家(MoE)架构,具备在推理时仅激活部分参数的稀疏计算特性。该模型在编程、数学推理及智能体(Agent)任务等领域表现突出,属于开源大语言模型系列,支持多种通用自然语言处理与生成任务。

核心事实

时间轴 (近 90 天)

6月1日

DeepSeek官方宣布DeepSeek-V4-Pro的优惠价格将延长至2026年5月31日(UTC时间15:59)

待验证85%
6月1日

DeepSeek-V4-Pro是DeepSeek推出的最新旗舰级大语言模型

已验证90%
6月1日

DeepSeek-V4-Pro API即日起至2026年5月5日享受75折优惠

待验证85%
6月1日

开发者可以在Claude Code中将模型设置为deepseek-v4-pro[1m]来使用DeepSeek-V4-Pro的百万上下文能力

待验证80%
6月1日

OpenCode需更新至v1.14.24及以上版本才能支持DeepSeek-V4-Pro

待验证80%
6月1日

OpenClaw需更新至v2026.4.24及以上版本才能支持DeepSeek-V4-Pro

待验证80%
6月1日

DeepSeek-V4-Pro支持100万(1M)token的超长上下文窗口

已验证90%
6月1日

文章核心要点中称DeepSeek-V4-Pro API享受75%折扣(仅需原价25%),与正文中75折(原价的75%)存在矛盾

待验证95%
6月1日

V4-Pro直接对标GPT-4o、Claude Sonnet等第一梯队的商业模型

待验证75%
6月1日

V4-Pro的总参数与活跃参数比例约为32:1的稀疏比

待验证90%

还有 1 条时间轴事件

全部知识事实 (20)

已验证

DeepSeek-V4-Pro是DeepSeek推出的最新旗舰级大语言模型

90%
已验证

DeepSeek V4采用混合专家模型(MoE)架构

90%
待验证

DeepSeek V4采用MUON优化器替代AdamW进行训练

85%
待验证

使用Claude Code + DeepSeek V4开发的C++浏览器可执行文件仅约200KB(动态链接模式)

85%
待验证

DeepSeek V4引入了流形约束超链接(Manifold-constrained Hyperconnection,MHC)作为对传统残差连接的升级方案

85%
待验证

该逆向项目的长期目标是对接DeepSeek V4等国产大模型,打造基于国产生态的AI编程工具

80%
待验证

AI Agent首次生成的浏览器核心代码仅约86行即可正常加载网页

80%
待验证

DeepSeek V4模型原本预计在3月发布,但已推迟到更晚时间

80%
已验证

DeepSeek V4在编程、数学推理和多语言理解方面表现突出

80%
待验证

DeepSeek V4采用了MoE(Mixture of Experts,混合专家)架构

75%
待验证

DeepSeek V4系列包含多个变体(如Fresh、Pro、Fancy),分别针对不同使用场景进行了优化

75%
待验证

DeepSeek V4已与升腾(华为)和寒武纪等国产硬件厂商展开深度合作

75%
待验证

原来跑百万上下文需要10张H20级别的显卡,DeepSeek V4现在1-2张就够了

75%
已验证

DeepSeek V4的API兼容了Anthropic的Messages API接口协议,允许原本为Claude设计的工具链无缝切换到DeepSeek的模型服务

70%
待验证

开发者已经成功将DeepSeek V4等第三方模型通过CCX桥接方式接入OpenAI的Codex桌面应用

70%
待验证

Claude Code配合DeepSeek V4可以让开发者从写代码的程序员转变为下达任务的项目经理角色

70%
待验证

DeepSeek V4的核心创新包括对MoE(混合专家)架构的持续优化和对训练流水线的深度工程调优

70%
已验证

通过修改Claude Code的连接配置,可以将后端模型从Claude替换为DeepSeek V4

65%
已验证

DeepSeek V4采用MIT开源协议,允许商业使用

65%
待验证

DeepSeek V4选择不使用N-gram技术,放弃了此前在V3/R1中探索过的Multi-token Prediction结合N-gram的方案

60%

来源文章