[控场AI]
· 7 分钟阅读· 3,729 字

GPT-6 Astra实测Blender:3D设计将迎变革还是虚火?

GPT-6 Astra实测Blender:3D设计将迎变革还是虚火?

GPT-6 Astra与Blender MCP实测:AI能自动化繁琐管线,但结构精度仍崩,3D设计师应从技工升级为导演。

B站UP主肥虫对GPT-6 Astra及Blender MCP工作流的深度测试表明,AI生成3D资产呈现"远看惊艳、近看崩塌"的特征:渲染效果可圈可点,但微观结构穿插、布线错误、关节装反等问题普遍存在,Token成本也相当高昂。AI真正的价值不在于生成成品级模型,而在于自动化骨骼绑定、控制器搭建等繁琐管线,以及作为视频生成的空间约束资产。对从业者而言,3D设计师的角色应从执行型"机械技工"升级为统筹型"3D导演",核心竞争力转向审美判断、全流程视野、AI指挥和商业表达四项能力。Blender因开源开放、全流程单体架构和成熟Python生态,成为AI时代最优先被适配的三维工具,过往积累的Blender经验不会被淘汰,反而是指挥AI的最佳"操作系统"。

GPT-6 Astra发布后,Blender意外成为焦点。铺天盖地的演示视频中,一句话就能生成3D资产的画面,让不少打磨多年建模、渲染、动画技能的行业设计师陷入集体焦虑——这些年苦练的本领,难道真的白学了?

B站UP主肥虫第一时间对GPT-6 Astra以及最新的Blender MCP工作流做了完整深度测试。结论既让人震撼,又给过度炒作泼了一盆冷水:AI能力确实惊人,但那些「行业颠覆」的言论大可不必当真。

硬表面、角色与场景:三轮实测的真实表现

肥虫分别拿硬表面建模、角色和全流程场景做了测试,结果呈现出明显的「远看惊艳、近看崩塌」特征。

在硬表面建模上,给Astra一张汽车参考图,用轻度模型跑了15分钟,反射、光影、质感都可圈可点。但一旦拉近视角、转到工程内部,问题就暴露了:零件大面积穿插、结构直接镂空、布线经不起推敲,而且烧掉了大量Token。唯一惊喜的是,AI对工程合集和图层的命名整理,比大部分实习生还要规范。

换到高推力模式做复杂机甲测试时,生成的渲染效果唬住了不少人,但对照结构参考,甚至连手指关节都装反了。这说明当前AI在「看起来对」和「结构真的对」之间,仍有明显鸿沟。

真正有意思的是AI在自动化管线上的表现

真正有价值的发现,在于AI对繁琐管线的自动化能力。通过Codex调用Hive 3D的MCP协议,仅19分钟就跑出了完整的、带骨骼绑定和运动控制器的Blender资产。虽然骨骼权重精度依然粗糙,但在搭建控制器、链接约束这些枯燥的底层逻辑上,AI已经能够接管。

**MCP(Model Context Protocol)**是Anthropic于2024年底提出的开放协议,允许AI模型通过标准化接口直接调用外部工具、数据库和软件API,而无需手动复制粘贴中间结果。在Blender工作流中,MCP的作用相当于给AI装上了"操作鼠标"的能力——AI不仅能生成代码建议,还能直接在Blender内执行命令、读取场景状态、修改节点参数。Codex则是OpenAI旗下专注代码生成的模型能力,负责将自然语言指令翻译为可执行的Python脚本,再通过MCP协议发送给Blender运行。两者的组合,使得"用对话驱动三维软件"成为可能,而不再只是停留在截图演示层面。Token在此语境下指AI模型每次推理消耗的计算单位,直接对应使用成本;复杂的3D生成任务因需要多轮迭代和长上下文,Token消耗量往往是普通文本任务的数十倍。

场景建模:AI的隐藏价值点

场景建模是这轮测试中被低估的亮点。当前AIGC视频在处理多机位、长动线时经常出现画面坍塌、空间错乱的问题。而肥虫在13分钟内让AI用Blender搭出一个几何场景模型——虽然质量一般,却可以直接作为Kling(C-Dance类)视频模型的硬性空间约束资产,用来解决镜头透视和动线问题。

Kling类视频模型正是眼前可见的例子

这个思路很关键:AI生成的3D资产不一定要「成品级」,它可以作为下游视频生成的「空间脚手架」。这种跨工具协同,可能比单纯追求高精度模型更具实用价值。

Kling(可灵)是快手推出的视频生成模型,属于"C-Dance类"(即基于参考图或条件控制的视频扩散模型)。此类模型的核心痛点在于缺乏三维空间意识:当镜头需要绕物体运动,或场景中多个角色同时移动时,模型容易出现透视崩塌、物体穿帮、动线不连贯等问题,根本原因是纯图像扩散模型没有对三维几何关系的显式约束。将Blender生成的轻量级几何场景作为"空间脚手架"输入给视频模型,本质上是为扩散过程提供深度图、法线图或相机轨迹等结构性先验,使模型在生成时受到物理空间的硬约束。这一思路与ControlNet对图像生成的结构控制逻辑一脉相承,是当前弥合"2D生成"与"3D一致性"之间鸿沟的主流工程方向之一。

AI的三个真实边界

综合几轮测试,肥虫给出了三点冷静判断,值得被反复强调。

微观层面依然粗糙。那种「多一分则僵、少一分则平」的细节微调,人类很难用文字精准描述给AI,因此高水准的细节把控问题短期内无法解决。

Token成本仍然偏高。模型会进步、成本会下降,但发展到最后,真正优秀的闭源大模型不会便宜到每个人随意使用——Kling的收费模式就是眼前的例子。

AI真正降维打击的是重复劳动。行业里那些苦不堪言的重复性工作、逻辑连线、节点化程序化模块,才是AI最先吃掉的部分。对创作者而言,AI一直是不错的能力补充,而非替代。

还要不要学软件?答案是肯定的

面对焦虑,肥虫的回答很明确:当然要学,但学习的目的彻底变了。

以前学习是为了让自己能上手干活;以后学习是为了判断AI干得对不对,以及精准告诉它该怎么干。3D设计师的身份,从埋头苦干的「机械技工」,升级为总揽全局的「3D导演」。

这也意味着行业入门门槛变得更加严苛。纯靠体力比拼工时、只会机械拉面和初级建模的岗位会被残酷压缩。未来行业只看重两件事:一是不可替代的审美与叙事构图,二是对顶级质量材质的物理法则、渲染管线的深度判断能力。

三五人精悍团队即可撬动数十人外包团队的产能

更深层的改变发生在商业结构上。过去大型写实资产需要大厂靠人海战术堆砌,如今Blender加AI成了独立工作者的「超级美术外挂」。未来或许会看到三五人的精悍团队,依托极低的时间成本,撬动以往数十人外包团队才有的产能体量。

未来3D设计师的四项核心能力

肥虫认为,AI加3D的内容生态里,真正能脱颖而出的人会在四项能力边界上做得出色:

  • 审美判断力:AI能瞬间给你一百个方案,但哪个更合适仍需你来决定,这需要长期经验积累,是AI给不了的。
  • 全流程视野:从概念到交付要经过哪些环节、每个环节瓶颈在哪。你不必每步亲手做,但必须每步都看得懂。
  • AI指挥能力:会写提示词、会设计工作流、会审查产出、会修复AI犯的错。
  • 商业表达能力:会找客户、会报价、会做作品集、会运营自媒体。前三条决定你能做出什么,最后一条决定你做出来的东西有没有人买单。

为什么爆发的是Blender,而不是老牌商业软件?

一个耐人寻味的现象:GPT-6 Astra的爆发没有带火那些老牌商业软件,反而直接引爆了Blender。肥虫说这件事他三年前就构想过,核心在于三点。

开源与全流程构架,是Blender被引爆的核心原因

开源且API极致开放。商业闭源软件不仅有高昂的授权年费,还有繁琐的席位限制;而Blender零门槛永久免费、代码彻底开源、无版权风险,外部工具调用几乎零阻力。

天然的全流程单体架构。建模、绑定、动画、结算到渲染,全部在统一数据环境内运转。AI在自动化串联管线时,不需要处理跨软件导出FBX的轴向混乱、材质丢失这类工业内耗。

高度成熟的全球开源生态。海量开源插件、Python脚本和规范工具,让它成为AI最容易学习、调用和适配的数据语料库。未来好用的3D AI工具和脚本,大概率都会优先适配Blender。

这也意味着,过往在Blender里积累的空间感知与流程经验不仅不会被淘汰,反而可能成为你指挥AI最得心应手的「操作系统」。

Blender的Python API和bpy模块为外部程序提供了完整的场景读写能力,几乎所有界面操作都可通过脚本复现,这是其他主流三维软件(如Maya、3ds Max、Cinema 4D)虽然也支持脚本但在开放程度和社区沉淀上难以比拟的关键差异。更重要的是,Blender的**节点化材质系统(Shader Nodes)几何节点(Geometry Nodes)**天然以数据流图的形式组织逻辑,这与AI生成代码的结构高度契合——AI可以通过增删节点、修改参数的方式精确控制程序化生成流程,而不需要解析复杂的二进制格式或私有协议。相比之下,商业软件的闭源格式和席位授权不仅增加了集成成本,也使其很难成为AI训练和适配的优先目标。Blender在GitHub上超过万星的插件生态,则为大语言模型提供了海量高质量的Python示例代码作为训练语料,进一步强化了AI对其API的"熟悉程度"。

变革是起点而非终点

站在AI浪潮下,开源被视为创新的开始,也是AI时代不可或缺的基石。每一次新兴创作工具的变革,都不是人类职业的终点,而是全新内容生态的起点。

对游戏、VR、XR等行业而言,Blender加AI的3D流程值得主动尝试。与其把AI当作洪水猛兽、或当成不学习的借口,不如积极拥抱——后者只会增加自己进入行业的难度。

分享:

相关推荐