AI日报:可灵4.0反击、Manus 2.0重生、Claude Sonnet 5.5发布

可灵4.0、Manus 2.0与Claude Sonnet 5.5同日更新,竞争焦点从能力堆叠转向效率与性价比。
同一天内,视频生成、智能体、大模型三条赛道各自迎来重量级更新。可灵4.0以多模态参考扩展、30秒原生视频和4K/HDR输出正面迎击Seedance;Manus 2.0引入Cascade架构,实现Agent技能按需动态加载,Token消耗降23.2%、任务时间降28.2%,并推出拥有真实账户与支付能力的个人Agent;Anthropic的Claude Sonnet 5.5则以半价逼近旗舰Opus 5.5的性能,并提速30%以上,主打日常开发办公场景。三次更新共同指向同一趋势:AI竞争的重心正从"能不能做到"转向"能不能又快又省地做好"。
沉寂许久的几位AI圈老玩家在同一天集体回归,视频生成、智能体和大模型三个赛道同时迎来重量级更新。可灵放出4.0预告向Seedance发起反击,Manus 2.0彻底重构底层架构,Anthropic的Claude Sonnet 5.5则主打"日常干活"性价比。这一波密集动作,折射出各家在不同细分领域的竞争思路。
可灵4.0:多模态参考与30秒原生视频
面对Seedance近期在视频生成领域的强势表现,可灵选择用一次大版本升级直接回应。据B站UP主Ever AI的梳理,可灵4.0能塞进至多15项多模态参考,支持10张关键帧输入,原生视频长度从此前的水平提升到30秒。
画质方面,4.0原生支持4K分辨率与10bit HDR输出,这对于追求专业级成片的创作者是实打实的提升。更关键的是提示词长度拓展至8000 Token,意味着用户可以用更精细、更结构化的语言去描述镜头、光影和动作细节,而不必再为字数上限反复删改。

发布节奏上,可灵采取了先放Flash轻量版供体验、完整版随后上线的策略。Flash版本已经开放,完整版预计10月推出。这种分阶段释放既能快速抢占用户心智,也给了团队打磨完整功能的缓冲期。从参数堆叠的力度看,可灵显然不打算在视频生成这条赛道上轻易让位。
Manus 2.0:Cascade架构与动态加载能力
相比可灵的参数升级,Manus 2.0的看点在底层逻辑的重构。新版本将底层换成了Cascade架构,核心思路是不再一开始就给Agent塞进所有Skill,而是根据项目进度动态加载所需的专业能力。

这种按需调用的设计带来了直接的效率收益:官方给出的数据是Token消耗减少23.2%,任务完成时间减少28.2%。对于长链路、多步骤的复杂任务而言,避免前期一次性加载全部能力,既省算力也降延迟,是当前Agent工程化中一个值得关注的优化方向。
与2.0同步登场的还有个人Agent产品线。这些Agent各自拥有独立的邮箱、电话、钱包和云电脑,能够替用户打电话、发消息,并在预算范围内完成付款。更有意思的是,多个Agent之间可以"拉个工作群"自行分工协作。

给Agent配备真实的身份账户与支付能力,意味着它从"生成内容的工具"向"执行任务的代理人"进一步靠拢。这类设计在提升实用性的同时,也把权限管理、预算控制和安全边界的问题摆到了台面上——如何确保Agent的自主行动不越界,将是这类产品落地要面对的现实挑战。
Cascade架构的核心思想与软件工程中的"懒加载"(Lazy Loading)理念相通:在传统Agent设计中,系统启动时会将所有工具、技能描述一次性注入上下文窗口,这会占用大量Token预算,且许多能力在特定任务中根本不会被调用。Cascade改为将Skill拆分成独立模块,在任务执行过程中根据当前步骤的实际需求动态拉取,类似于微服务架构按需调用子服务。这种设计对长链路Agent尤为关键——任务步骤越多、涉及领域越杂,前期全量加载造成的浪费就越显著。23.2%的Token削减不只是省钱,在模型上下文窗口有限的条件下,它也意味着Agent在同等窗口大小下能处理更复杂、更长程的任务,而不会因上下文塞满而导致推理质量下降。
Claude Sonnet 5.5:性价比路线的日常主力
Anthropic的更新走的是另一条务实路线。Claude Sonnet 5.5定位为"更适合日常干活"的模型,典型场景包括修复代码BUG、制作文档和PPT,据称在设计审美上也有不错的表现。

最吸引人的是性价比数据:Sonnet 5.5性能比肩更高端的Opus 5.5,但价格仅为其一半,同时生成速度比前代Sonnet 5快30%以上。对于高频调用、注重成本的日常开发与办公场景,这种"接近旗舰性能、腰斩价格"的组合极具吸引力。
从产品策略看,用中端型号逼近高端表现,正在成为大模型厂商拉动使用量的常见打法。它让更多预算有限的开发者和团队能够用上接近顶级的能力,也在无形中抬高了整个行业的性价比基准线。
大模型的定价通常以每百万输入/输出Token计费,旗舰模型(如Opus系列)单价往往是中端模型的数倍乃至十倍以上。对于需要高频调用API的开发者或企业,模型价格直接决定项目的可行性边界。Anthropic将Sonnet 5.5定价设为Opus 5.5的一半,意味着同等预算下可以完成大约两倍的调用量,这对代码审查、文档自动化等批量处理场景具有实质意义。值得注意的是,"性能比肩"通常指在主流基准测试上接近旗舰水平,但在极端复杂推理或超长上下文任务中两者可能仍有差距,用户需要根据自身实际场景评估是否适合以Sonnet替代Opus。
三条赛道的共同信号
把这三条更新放在一起看,能读出一些共性趋势。可灵在视频生成上继续以参数和画质硬碰硬;Manus把重心放在Agent的工程效率和真实执行力上;Claude则在性能与价格的平衡点上做文章。
无论是可灵的动态多模态、Manus的按需加载,还是Claude的速度与成本优化,背后都指向同一个方向——从单纯堆能力,转向让能力更高效、更实用、更可负担地落到用户手里。竞争的焦点,正在从"能不能做到"逐步转向"能不能又快又省地做好"。
相关推荐

无GPU也能跑大模型?老旧DDR3服务器的本地推理性价比探讨
一场Reddit讨论探讨了无GPU本地部署大模型的可行性:用老旧DDR3多路服务器靠内存带宽跑Qwen 3.8 Flash,以及4bit量化、KV缓存与上下文长度的实用权衡与电费成本争议。

拓扑域外泛化:让AI预测系统从未见过的动力学突变
NeurIPS论文提出拓扑域外泛化方法,通过特征分离与物理稀疏先验修复分层DSR模型缺陷,使AI能在不知控制参数的情况下预测系统分岔与动力学突变,适用于PLRNN和Neural ODE。

用不好AI Agent是你的错吗?破解AI工具焦虑的实用指南
用不好AI Agent是你的能力问题吗?本文从产品成熟度、使用预期和场景匹配三个角度剖析AI工具使用困境,提供破解AI焦虑的实用方法与选型建议。