DeepSeek开源304B视觉模型,GPT-6传闻与API计费收紧全解读

DeepSeek开源304B视觉模型,GPT-6传闻升温,API计费与账户安全问题同步成为行业焦点。
本轮AI行业动态呈现出技术突破与商业收紧并行的双重主题。DeepSeek深夜开源304B参数的多模态视觉模型FlashVision EXP,采用MoE架构与FP4量化,以MIT许可延续其开放生态策略,但本地部署门槛极高。与此同时,GPT-6发布信号密集,多个间接迹象指向本周发布。在商业层面,谷歌NotebookLM与OpenAI相继收紧用量配额,"订阅即无限用"时代正式终结。安全侧,Anthropic披露窃密木马盗取Claude账户凭证的事件,提示会话Cookie劫持可绕过MFA。国产大模型方面,智谱与MiniMax的商业数据显示头部厂商已从卷模型转向卷收入。整体而言,降本、商业化与安全合规已与技术竞赛并列成为行业下半场核心议题。
DeepSeek深夜开源:304B视觉模型补齐多模态版图
DeepSeek再次选择在深夜出手。这一次,团队在Hugging Face上开源了V4系列的首个视觉模型——FlashVision EXP,采用宽松的MIT许可协议,标志着DeepSeek正式将多模态这块关键拼图补齐。
从技术参数看,这款模型的设计颇具野心。模型总参数量高达304B,但采用MoE(专家混合)架构,推理时仅激活6个专家,配合FP4量化精度,在保证效果的同时控制了实际计算开销。上下文长度支持达到惊人的100万Token,为长文档理解、复杂视觉推理等场景提供了充足空间。
在多模态智能体的跑分测试中,FlashVision EXP相比前代有明显提升。不过需要泼一盆冷水:304B的总参数量意味着本地部署几乎不可能,普通用户和中小团队想要真正跑起来,门槛依然很高。
开发者如何快速上手FlashVision EXP
对于有意尝试的开发者,建议先去Hugging Face查阅权重文件和基准卡(benchmark card),重点关注单图384 Token的上限设置,把它接入自己现有的多模态管线后再做实际评估。开源不等于即插即用,模型的真实价值需要在具体业务场景中验证。
你可能没注意到,DeepSeek持续以MIT许可开源核心模型,这在国产大模型阵营中形成了鲜明的路线选择——用开放生态换取影响力和开发者认同。
GPT-6要来了?多条信号指向本周发布
围绕OpenAI下一代模型的传闻正在密集发酵。多个渠道消息指向,代号为"Astra"的GPT-6可能于本周四发布,尽管这些信息均未获得官方确认。
一个耐人寻味的信号是:Sam Altman换回了旧头像,这类看似无关的举动往往被社区解读为发布前的预热。同时,Sora模型在推理阶段出现频繁重置、恢复5小时限额的情况,被不少观察者解读为"新模型发布前的清场动作"——为新算力腾出空间。

对于依赖这些工具的用户,一个务实的建议是:把手头固定任务的执行结果截图留底,等版本更新后用同一组任务重新测试,再判断是否需要跟进新版本。这种"对照实验"的方法能有效避免主观误判。
无限用时代结束:API普遍转向计算量计费
本轮新闻中最值得警惕的行业信号,是各大平台计费模式的集体转向。
谷歌官宣NotebookLM从9月2日起改按计算量计费,并新增5小时窗口限额。这意味着任务越复杂,配额消耗越快。叠加OpenAI恢复5小时限额,过去"订阅即无限用"的时代正在落幕。

对重度用户的实操建议很明确:把批量任务尽量在计费政策生效前跑完,然后到设置里确认自己账户的配额倍率。计费模式的收紧背后,是大模型厂商在算力成本压力下的普遍选择——降本与商业化正成为下半场的主旋律。
安全警报:Claude账户遭窃密木马攻击
Anthropic披露了一起安全事件:黑客利用Cedar、Amos等窃密木马盗取Claude的登录凭证,进而盗用用户的绘画和API额度。作为应对,官方强制登出受影响账户并删除了绑定的付款方式。

这起事件暴露出一个严峻现实:账号资产可能被直接窃取,甚至连多因素认证(MFA)也存在被绕过的风险。安全建议非常具体:立即检查登录设备、退出所有活跃会话、清理Cookie,Mac用户顺手跑一次杀毒扫描。
同一天,索尼起诉Anthropic的案件也再度被提及,主线仍是版权与平台规则收紧的博弈。AI厂商在合规与安全两条战线上都面临越来越大的压力。
专业解读:为什么你会感觉"模型变笨了"
很多用户抱怨模型"降智",但这背后未必是底座模型真的变差了。

更常见的原因有三个:一是路由系统悄悄切换到了更省成本的模型;二是推理预算被削减;三是安全策略收紧。这就好比同一个服务窗口换了一位更注重成本控制的柜员——表面没变,体验却下降了。
因此,判断模型是否真的退步,正确的方法是固定输入入口、固定提示词、固定任务,再做横向对比,而不是凭主观感受下结论。
国产大模型:从卷模型转向卷收入
商业化数据同样值得关注。据报道,智谱上半年营收达9.539亿元,同比涨4倍,API收入更是暴涨27倍;MiniMax在8月ARR超过8亿美元,付费(ToP)占比升至63%。
这组数据揭示了一个清晰趋势:国产头部厂商正从"卷模型"转向"卷收入",降本与商业化成为下半场的核心竞争点。对于做国产API采购的团队,建议把两家最新报价做成比价表,做足功课再下单。
结语
从DeepSeek补齐多模态、GPT-6发布传闻,到API计费收紧、账户安全事件,本轮AI圈的新闻共同勾勒出一个趋势:技术竞赛仍在加速,但成本控制、商业化与安全合规已同步成为行业的主线议题。对开发者而言,保持技术敏感度的同时,做好成本核算与安全防护,缺一不可。
相关推荐

@ai-sdk/zai@3.0.10 发布:依赖更新的补丁版本解析
Vercel AI SDK 发布 @ai-sdk/zai@3.0.10 补丁版本,同步更新 provider、provider-utils 与 openai-compatible 等底层依赖。本文解析该版本变更内容及 AI SDK provider 体系的设计意义。

Vercel AI SDK 更新:@ai-sdk/workflow 2.0.29 修复工具结果保留问题
Vercel AI SDK 发布 @ai-sdk/workflow 2.0.29 补丁版本,核心修复工作流在终止、延迟、暂停三种响应状态下 provider 工具执行结果的保留问题,并同步升级 ai@7.0.98 等核心依赖。

Vercel AI SDK 更新:@ai-sdk/xai 4.0.58 批处理与图像生成改进
Vercel AI SDK 发布 @ai-sdk/xai 4.0.58 版本更新,新增批处理图像生成支持,修复批处理请求类型校验及 DeepSeek 推理流问题,并同步升级 provider 相关依赖。