[控场AI]
· 7 分钟阅读· 3,516 字

零基础做AI漫剧全攻略:剧本到角色设计完整教程

零基础做AI漫剧全攻略:剧本到角色设计完整教程

三工具零基础制作AI漫剧:用万能提示词框架写剧本,用参考图锁定角色风格。

本文拆解了B站UP主"初一"分享的AI漫剧完整制作流程,聚焦最核心的剧本创作与角色设计两个环节。核心工具只需即梦(生图/视频)、豆包(内容创作)、剪映(成片)三个,基础功能全免费。剧本创作的关键是掌握"万能提示词三要素"——角色身份、具体需求、输出格式,并在直接分镜、先故事后分镜、爆款二次创作三种方法中按需选择;新手推荐先写故事再拆分镜,想快速起号则借力爆款框架。角色设计要同时保证跨镜头的形象统一性和与故事调性的氛围契合,参考图定风格是最可控的方法。无论剧本还是角色,最终都必须经过人工审核,这是保证成片质量的底线。

AI漫剧正在成为内容创作的新赛道。随着Gemini 3、GPT Image等大模型能力的跃升,把一部小说转化为电影级分镜、生成统一的角色形象、一键导出成片,已经不再是专业团队的专利。B站UP主初一在最新的教程中拆解了一套完整的AI漫剧制作流程,即便是从未接触过剪辑的纯小白,也能独立产出一部完整作品。

本文基于该教程整理,重点讲透最核心的前两步——剧本创作与角色设计,帮你把基础打牢。

只需三个核心工具,基础功能全免费

很多人以为做AI漫剧要装几十个复杂软件,实际上核心工具只有三个,而且基础功能全部免费。

  • 即梦:负责生成静态画面和动态视频。做短剧情练手,免费额度完全够用;若要稳定更新几十集的长篇账号,开会员的性价比也较高。
  • 豆包:整个流程的"内容大脑",写剧本、出设定、改文案全靠它完成。教程中所有创作方法用豆包即可落地。
  • 剪映:最后把生成的视频拼接起来,加字幕、配音乐、导出成片,操作简单,看两遍就能上手。

完整的学习体系被拆成七个模块:剧本与角色设定、图像生成、动态效果制作、音视频创作、剪映成片、接单变现、发布运营。本文聚焦最关键的前两个环节。

AI剧本创作:掌握万能提示词三要素

"AI写的剧本没法用"是新手最常见的抱怨,但问题的本质往往不在AI,而在于你不会正确提问。教程总结出一套万能提示词的三要素框架:

三要素框架

第一,角色身份设定。给AI贴一个专业标签,让它站在专业角度思考。写都市职场剧本,就设定为"从业二十年的都市剧资深编剧";写儿童向内容,就设定为"资深儿童绘本作家"。身份定得越准,内容专业度越高。

第二,具体需求描述。题材、时长、风格、核心要点、背景设定全部讲清楚,别让AI去猜。你说得越具体,输出才越精准。

第三,输出格式要求。直接告诉它你想要什么样式,省得后期反复返工。比如"输出15个分镜,每个分镜对应4秒画面,包含视觉描述、台词和镜头运动"。

豆包中输入带身份设定的提示词进行测试

教程用一个实例验证了身份设定的威力:同样问"年轻人为什么喜欢国风手作",把AI设定为"国风文创店店长"时,得到的是文化情绪共鸣、个性表达、情绪价值等运营视角的答案;换成"普通消费者"身份,答案则变成拍照出片、不撞款、有氛围感。身份不同,输出完全不同。

这套三要素框架本质上是"角色扮演提示词工程"(Role-based Prompting)的实践应用。大语言模型在训练时吸收了大量不同职业、不同视角的文本,通过给模型赋予具体身份,相当于激活了它在对应领域的知识分布,使输出更贴近该领域的专业表达习惯和思维框架。"输出格式要求"这一要素则对应"结构化输出"技巧——明确规定镜号、时长、景别等字段,可以让模型的生成结果直接与后续工具(如即梦的分镜输入)对接,减少人工二次整理的损耗。对于新手来说,三要素框架最大的价值在于把"我想要什么"这个模糊的心理诉求,拆解成模型能够稳定响应的结构化指令,从而大幅降低多次反复沟通的概率。

三种剧本生成方法:从快到稳

教程给出三种剧本生成路径,可根据需求灵活选择。

方法一:直接输出完整分镜剧本

最大优势是快,一步到位,适合赶稿或临时要方案。用三要素框架发一条指令,比如"假设你是顶尖治愈系画师,创作一个以海滨渔村为背景的短片脚本,15个镜头,每镜不超过4秒",即可直接出分镜。

缺点也明显:辞藻过于华丽,像"细碎金光落在微波上"这类抽象描写,后期AI生成视频时识别不到。解决办法是追加一条指令,要求"描述直白具象,少用抽象修辞,方便AI生成画面"。

方法二:先生成故事再转分镜

这是教程最推荐的稳妥做法,逻辑稳、bug少。先让AI写一个400到500字、情节闭环的完整故事,理顺逻辑后再拆成分镜。

设定AI为儿童文学作家生成完整故事

关键在于生成故事后一定要通读,检查有没有逻辑不通的地方。确认无误再让AI创作分镜,输出会包含镜号、时长、画面描述、景别、角色动作、音效和对白,每个时长控制在4秒内。这样出来的分镜故事逻辑通顺、画面描述落地,踩坑概率远低于方法一。

方法三:借鉴爆款框架二次创作

最稳妥、最容易出结果,适合想做账号或跑变现的人。别人的爆款框架经过市场验证,你只需把角色、场景、道具替换掉,就是一个全新故事,风险低、起号快。操作时把爆款故事复制到新对话,让AI"参考上面的故事框架,替换角色、场景、核心道具,创作全新的治愈成长故事",既保留爆款节奏又不撞款侵权。

选择建议:新手入门优先方法二;想快速起号做账号选方法三;赶时间出初稿用方法一。

剧本必须人工审核

剧本生成后千万不要图省事直接使用

教程反复强调:垃圾剧本必然做出垃圾视频。一集卖剧不过一到三分钟,文案几百上千字,通读一遍花不了几分钟。小细节直接改;若是整体框架、核心冲突或叙事节奏的大方向问题,就整理出具体修改指令(如"增加反转""缩短铺垫")反馈给AI二次生成。别图省事,等画面做出来才发现剧本有问题,返工既费时间又浪费金钱。

角色设计:解决人脸崩坏的关键

新手做卖剧最头疼的就是人脸崩坏——同一个人上一镜头这样、下一镜头就变了,观众直接跳戏。角色设计有两个核心意义:

  • 统一性:同一角色的发型、服装、五官特征在不同场景保持一致,不能前一镜头高马尾、后一镜头齐刘海。
  • 氛围契合:治愈系故事配柔和Q版造型,悬疑故事配冷峻写实风,画风要与故事调性匹配。

三种角色设计方法

方法一:剧本驱动提示词生成。最省事,把定稿剧本上传给豆包,先让AI提取所有人物(检查有无遗漏),再让它以"顶尖角色设计师"身份设计出Q版角色的外貌提示词。注意正向和负向提示词都要复制粘贴到图像生成对话中。想省成本用豆包,想要更好效果可用即梦模型。

方法二:参考图定风格。如果你找到了喜欢的画风却说不清具体风格,直接把参考图上传给AI学习,再生成角色。找灵感可打开即梦的"灵感"板块搜索关键词,或直接截取喜欢的图给豆包,让它"参考这张图的绘画风格生成角色,风格与参考图完全一致"。

上传参考图让AI学习画风生成角色

教程指出,用参考图生成的角色画风与原图高度一致,比纯文字描述精准得多。想保证全篇画风统一,参考图是最可控的方法。

方法三:AI辅助快速出稿。适合项目初期头脑风暴,不用参考剧本也不用参考图,直接给指令(如"生成2D水彩Q版10岁女孩形象"),速度快、迭代灵活,不满意可继续微调发色、服装等细节。

选择建议:只定出稿方向用方法三;正式定稿推荐前两种。无论哪种,生图前都要先明确画风到底是2D插画、CG动画还是水彩风格,有参考图时优先用参考图,"比你写100句提示词都管用"。

AI生成图像中人脸不一致的根本原因,在于当前主流的扩散模型(Diffusion Model)每次生成都是独立采样过程,并不天然具备跨图像的"角色记忆"。即梦、Midjourney等工具通常通过"参考图风格迁移"或"IP-Adapter"类技术,将参考图的特征向量注入生成过程,从而约束输出的外观一致性。这也解释了为什么教程反复强调参考图比文字描述更可控——文字描述依赖模型对词语的语义理解,存在歧义空间;而参考图直接提供视觉特征向量,约束更精确。在实际操作中,除了参考图之外,保持同一个对话上下文、不更换模型版本、固定随机种子(Seed)也是维持角色一致性的常用辅助手段。

核心要点总结

把整套方法论浓缩为三条原则:

  1. 剧本创作用万能公式:三要素框架能避免反复与AI来回唠叨。
  2. 角色设计要统一画风与氛围:确保角色形象与故事背景高度契合,兼顾视觉辨识度和情感共鸣。
  3. 人工审核是底线:无论剧本还是角色设计,都要经过人工把关。

新手做分镜,先把故事写好再拆分镜,能有效降低门槛、积累经验;想快速起号,借力爆款二次创作能大幅压缩时间成本。正如教程结尾所言:"创意源于积累,执行重于空想。"从第一个剧本开始动笔,经验才会慢慢累积。

分享:

相关推荐