DeepSeek V4.1 Flash实测:Flash反杀Pro旗舰

DeepSeek V4.1 Flash以更低价格和原生多模态能力全面超越旗舰V4 Pro,后者随即宣布下线。
DeepSeek发布V4.1 Flash模型,官方宣称其在性能、速度、费用等各项指标上全面超越旗舰V4 Pro,并原生支持多模态视觉理解。通过3D城市生成器与AI绘图工具两轮实测,V4.1 Flash凭借原生视觉自检能力、三倍于Pro的输出速度和更高稳定性拔得头筹,V4 Pro因缺乏视觉能力在细节还原上明显落败。成本对比同样悬殊:Flash完成两个项目共花费不足10元,Pro仅一个项目就消耗约16元。DeepSeek随即宣布V4 Pro下线并将请求自动路由至Flash,此举虽被定性为免费升级,却引发开发者对生产环境模型行为一致性的担忧,折射出大模型快速迭代与企业侧版本稳定需求之间的普遍矛盾。
Flash模型全面超越Pro,DeepSeek改写产品逻辑
DeepSeek刚刚正式发布了V4.1 Flash模型,这次更新的力度远超预期。新模型采用了全新的模型结构,原生支持多模态视觉理解,并且直接开源。更关键的是,官方宣称V4.1 Flash在性能、费用、速度、总用时等各项指标上已经全面超越了旗舰级的V4 Pro。
这带来了一个反常识的结论:便宜好几倍的Flash模型,效果反而比旗舰更好。既然如此,Pro模型的存在意义也就消失了——DeepSeek随即宣布V4 Pro即将下线,所有发给Pro的请求将自动路由到V4.1 Flash。可以说,Flash彻底把Pro干掉了。
另一边,DeepSeek网页版也做了大幅简化。原来的"快速、专家、实图"三个模式被合并成了一个统一入口,用户不再需要手动切换模型。AI会根据任务复杂度自动调度,检测到图片就自动激活视觉能力,交互体验明显更顺畅。
3D程式生成器测试:视觉能力成关键分水岭
程序员鱼皮准备了两个不同类型的项目进行实测,并拉上GLM 5.3 Flash一起横向对比。第一个任务是让AI做一个程序化3D城市生成器网站,做完后需要自主验证效果,重点考察前端编码、3D建模和视觉理解能力。
V4.1 Flash的输出速度达到了每秒287 tokens,相当惊人。不过由于工具调用和视觉理解花费了较长时间,总用时被拉到了83分钟。成品效果第一眼看上去不错,错综复杂的重庆山城都被还原了出来,右侧还配有完整的程式生成器控制面板,支持拖拽和滚轮自由缩放视角。

反观V4 Pro,它最大的短板就是没有视觉能力。AI写完代码后只能调用子agent,让其他有视觉能力的模型帮忙验证。结果重庆的建模精细度明显不如Flash,上海的东方明珠更是被做成了"糖葫芦",还悬浮在水面上,直接翻车。
GLM 5.3 Flash的表现介于两者之间,氛围感(灯光、夕阳)营造得不错,但细节bug较多,出现了穿模和无来由的飞行方块。综合来看,V4.1 Flash的完成度和细节丰富度最高,GLM 5.3 Flash与其半斤八两,V4 Pro则明显垫底。

值得一提的是,作为参照,全球顶级模型GPT-6 Ostra用同样提示词只花18分钟就完成了高精度生成。但Ostra价格昂贵数倍,拿来和Flash比效果并不公平。
全栈工程测试:稳定性与速度的双重胜利
第二个项目是开发一个AI智能绘图工具,重点考察全栈工程能力。这一轮V4.1 Flash的优势体现得更加明显。
它做出的界面布局很有科技感,还主动将开源项目深度融合进来并修改了产品名,细节到位。实测画图功能时,可以实时看到AI的思考过程,输出速度极快,20秒左右即可完成,画出的节点整齐、没有错位,明显优于此前V4 Pro的表现。更重要的是稳定性——鱼皮试了很多轮都没有出现过生成失败的情况。

GLM 5.3 Flash的页面同样有科技感,功能也算完整,但偶尔会出现连线错位和生成失败的问题,稳定性稍逊一筹。而V4 Pro的版本则问题不少:页面打开就有bug,右侧画布默认显示空白和加载图标,AI思考过程无法实时输出,生成速度和准确度都一般。
结论清晰:这一轮V4.1 Flash胜出。它的功能和界面与GLM 5.3 Flash旗鼓相当,却只花了对方一半的时间,效果还更稳定。
速度与成本:三倍提速,价格腰斩
除了任务实测,鱼皮还额外做了一组速度对比:让两个DeepSeek模型用相同提示词各写一篇一万字小说。结果V4.1 Flash的输出速度是V4 Pro的整整三倍,首token延迟也大幅降低,基本能做到秒回。

成本方面的对比更为夸张。V4 Pro光是做一个3D程式生成器就花了约16元,而V4.1 Flash开发完两个项目才花了不到10元,平均每个项目5元左右。
另一边,DeepSeek同步调整了Flash系列定价,空闲时段缓存命中的输入价格降到了0.02元/百万token,日常开销大幅下降。可以说,DeepSeek重新具备了作为日常AI编程和办公推荐模型的性价比。
V4 Pro下线引争议:免费升级还是业务风险?
尽管V4.1 Flash表现亮眼,V4 Pro即将下线这件事却引发了争议。DeepSeek的本意是给用户免费升级模型,但不少开发者提出了担忧:自己的产品已经接入了V4 Pro,突然被自动切换模型,可能会影响线上业务的稳定性和一致性。
这实际上揭示了一个更普遍的问题——当模型供应商快速迭代时,如何平衡"技术升级"与"生产环境稳定"之间的矛盾。对于将大模型深度嵌入产品的企业来说,模型行为的突变意味着未经验证的风险。这也提醒开发者,在选择底层模型时需要留意供应商的版本管理和废弃策略。
无论如何,从这次实测来看,V4.1 Flash用更低的价格、更快的速度和原生多模态能力,实现了对自家旗舰的"反杀",也再次展现了DeepSeek在性价比路线上的执着。
相关推荐

Treebar:Mac菜单栏管理Git工作树,一眼掌控所有AI编程Agent
Treebar是一款macOS菜单栏应用,专为AI编程多工作树场景设计。它将所有Git Worktree状态统一展示在MacBook刘海区域,让开发者实时监控Codex等AI Agent的工作进度,无需切换终端即可掌握全局。即将开源核心代码。

苹果确认Hide My Email域名永久保留,用户隐私获长期保障
苹果公司公开承诺iCloud+ Hide My Email功能使用的@icloud.com域名将永久保留,不会弃用或迁移。本文解析域名稳定性对邮箱转发隐私工具的关键意义,以及对用户账户安全的底层保障。

终端正在拖慢你:多任务时代的效率反思
终端是程序员的信仰工具,但在多任务并行的现代开发场景中,它的线性设计正在成为效率瓶颈。本文分析终端的心智负担模型为何在第六个任务时崩溃,以及开发者该如何重新评估工具选择。