本文由 辛梓煜@词元2号站(www.ciyuanerhao.com)撰写,系个人学习实践总结,转载请注明出处。
快速摘要
如果你只想要一句话的结论,那就是:AI 漫剧本质上是一条"文字变动画"的流水线,真正决定成品质量的不是绘画功底,而是你会不会用大语言模型写剧本、会不会拆分镜。整条流程可以拆成五步——找授权素材、把小说改成推文剧本、把剧本翻译成分镜脚本、用视频模型逐段生成、剪辑合成。其中最容易被新手忽略、又最能拉开差距的,是"分镜脚本"这一步:景别、运镜、光影、场景、台词、音效一个都不能少,还要按视频模型的单次时长(豆包 Seedance 2.0 支持 5 秒和 10 秒、即梦最长 15 秒)来切片,每段至少三个分镜、统一风格与色调。把这套模板固定下来,你就拥有了一条可以稳定复用的生产线。
上面这段是给"只想要答案"的朋友准备的。但 AI 漫剧真正的门道,藏在每一个"为什么"里:为什么要给 AI 设定身份?为什么开头必须做成钩子?为什么分镜要卡在十秒?为什么同一个角色会越画越不像?这些坑我基本都踩过一遍。想看完整拆解,往下翻。
一、先把 AI 漫剧这件事讲清楚
这两年刷短视频,你大概率刷到过这样的内容:竖屏、二次元画风、一集一两分钟,讲的是小说里的爽点情节,画面会动、有配音、有音效,看完这一集,结尾往往卡在一个悬念上,让你忍不住想点下一集。这类内容就是现在被叫做"AI 漫剧"的东西。
它跟传统动画最大的区别,是制作门槛被彻底打下来了。搁在几年前,做一段哪怕只有一分钟的动画,背后都得站着一整个团队:画师画原画、编剧写本子、导演定分镜、声优配音、后期做特效……普通人根本碰不起。而现在,一个人坐在电脑前,用几个免费或低成本的 AI 工具,就能把脑子里的故事变成能动、能看的成片。
我自己第一次完整跑通一条 AI 漫剧的时候,最大的感受不是"哇好神奇",而是——这玩意儿的本质是工程,不是艺术。你不需要有多强的审美天赋,你需要的是把一件复杂的事拆解成标准化的步骤,然后让 AI 在每一步替你干最费时间的体力活,你只负责做判断和把关。辛梓煜@词元二号站这半年折腾下来,越来越确信一句话:AI 时代,创作者的核心能力正在从"手上功夫"转向"导演思维 + 提示词工程"。
1.1 它的内容形态:一条能"连载"的动漫短剧
AI 漫剧通常是连载的。也就是说,你不是做一条孤零零的视频,而是围绕一本小说、一个故事线,一集一集往下更。这种形态有两个天然的好处:
一是素材可以复用。角色的形象、场景的设定,第一集建好了,后面几十集都能接着用,越往后做越快。
二是节奏可以标准化。开头三秒抓眼球、十秒一个爽点、结尾留钩子——这套节奏一旦跑通,就变成了你的模板,套用起来又快又稳。
需要说明的是,本文只聊"怎么把一部 AI 漫剧做出来"这件手艺活本身,不涉及任何平台的分成、结算这类话题。我更关心的是:作为一个想学会这门技能、提升自己内容创作能力的人,这条流水线到底该怎么搭。
1.2 为什么现在是学这门手艺的好时候
一个很现实的原因是:AI 视频模型这一年进步得太快了。以字节的 Seedance 2.0 为例,它在 2026 年 2 月正式接入豆包和即梦,支持文本、图片、视频、音频四种模态混合输入,还能做到原生的多镜头叙事和音画同步。换句话说,你给它一段结构清晰的分镜描述,它就能吐出一段镜头连贯、带原声的动画片段——这在一年前是想都不敢想的。
工具越来越顺手,也就意味着留给"审美、认知、专业判断"的竞争空间越来越大。工具门槛降到地板,大家拼的就不再是"你会不会用软件",而是"你会不会讲故事、会不会拆镜头"。这恰恰是这门手艺最值得学的地方。
二、动手前,先看懂整条流水线
在讲每一步的细节之前,我想先让你对全局有个概念。很多新手一上来就扎进"怎么生成视频",结果发现前面的地基没打好,后面全是返工。整条 AI 漫剧的生产流水线,我习惯拆成下面五个大环节:
flowchart LR
A[找授权素材<br/>选一本合适的小说] --> B[改剧本<br/>小说→推文剧本]
B --> C[拆分镜<br/>剧本→分镜脚本]
C --> D[生成画面<br/>角色/场景/分镜图]
D --> E[生成视频<br/>逐段跑视频模型]
E --> F[后期合成<br/>剪辑/配音/音效]
style C fill:#ffe6cc,stroke:#d79b00,stroke-width:2px
我特意把第三步"拆分镜"标成了高亮,因为它是整条链路里承上启下、也最考验功力的一环。前面的剧本再好,如果分镜拆得乱,视频模型就会给你返回一堆不知所云的画面;后面的视频模型再强,也救不了一个逻辑断裂的分镜表。
本篇文章的重点,会放在前三步——找素材、改剧本、拆分镜。因为这三步是"从零到有一份可执行方案"的过程,也是新手最容易卡壳、最需要有人掰开揉碎讲清楚的部分。至于生图、生视频、剪辑合成这些偏"执行"的环节,涉及具体工具的参数调优,我会放到后面单独展开,本文先把"作战地图"给你画明白。
这里先埋一个贯穿全文的核心心法:把创意交给 AI 去实现,把判断留给自己。你不需要亲自当编剧、画师、剪辑师,但你得知道"什么是好的",然后从 AI 给出的一堆方案里,挑出最符合你故事感的那一个。
三、第一步:找到能放心用的原始素材
3.1 为什么"版权"是这一步的底线
AI 漫剧大多是拿小说的情节来改编的。这就带来一个绕不开的问题:你用的这本小说,你有没有权利拿来做二次创作?
这不是小题大做。网上有大量看起来"免费好用"的小程序、第三方渠道,号称能给你小说授权,但很多来路不明,用了之后哪天被找上门就麻烦了。所以我的原则很简单:只从官方渠道拿有明确授权的素材。宁可选择少一点,也别在版权这种底线问题上冒险。
3.2 官方授权渠道:番茄达人中心
目前对新手比较友好的一个正规渠道,是字节旗下的番茄达人中心(官网 kol.fanqieopen.com)。它是番茄官方的达人推广平台,里面有海量正版内容授权,覆盖番茄小说、番茄畅听、红果短剧等多个内容池,选书之后可以直接拿到授权,不用自己去一个个联系作者——说实话,你私信作者,人家多半也不会理你,因为版权本来就握在平台手里。
它的大致使用逻辑是这样的:
- 注册并绑定账号:进入平台,按提示注册,绑定你的自媒体账号。
- 选书:平台里的小说数量很多,男频、女频都有。你可以顺着榜单(比如飙升榜、热门榜)去挑,优先选那些冲突强、节奏快、爽点密的题材,这类内容天然适合改成短剧。
- 申请别名并获得授权:选定一本书后,给它起一个"别名"(也叫关键词),提交申请。别名不能和原书名相同、也不能和别人已经占用的重复,通过审核后,这本书的授权就落到你名下了。
这里有个小提醒:热门连载中的签约作品,版权方盯得最紧,新手起步可以优先考虑那些相对没那么火、但情节扎实的书,通过率会高一些。
说到题材,我再多啰嗦两句选书的经验,因为选对题材,等于成功了一半。适合改成 AI 漫剧的小说,通常有几个共同特点:一是开篇就有强冲突,不需要铺垫太久就能抛出爆点;二是情绪外化,人物的爱恨、复仇、逆袭都写得很外放,容易转成看得见的画面;三是单元感强,能拆成一个个相对独立的小高潮,方便你一集一集地更。像重生、逆袭、复仇、悬疑这类题材,天然就带着这些属性,改起来顺手,也容易被观众接受。相反,那种大量靠内心独白、氛围铺陈取胜的文艺向作品,虽然文字好看,但转成短剧画面会很吃力,新手阶段不建议碰。
选书时还有个小技巧:顺着榜单挑,但别只盯着第一名。榜单靠前的书往往竞争激烈、别名也被占得差不多了,你可以往榜单中段找一些数据不错、题材对味、又还没被做烂的书,性价比更高。
3.3 把小说整理成干净的文本
拿到授权、确定要做哪本书之后,别急着丢给 AI。先做一步很朴素但很关键的准备工作:把要用的章节内容复制出来,整理成一个干净的文本文档保存好。
我一般会新建一个 Word 或者纯文本文件,把小说对应章节的正文粘进去,顺手把里面的广告、乱码、多余的空行清理一遍。这一步看着不起眼,但它决定了你后面喂给 AI 的"原料"干不干净。原料脏,AI 输出的东西也跟着脏,这是铁律。
到这里,你手上就有了一份干净、有授权、情节完整的小说文本。这就是整条流水线的起点。
四、第二步:把小说"翻译"成能拍的剧本
4.1 为什么不能直接拿原文去生视频
很多新手会有一个直觉:我都有小说原文了,直接把文字丢给视频模型不就行了吗?
答案是:不行,而且差得远。
原因有两个。第一,小说是写给人"读"的,不是写给 AI"拍"的。小说里有大量的心理描写、环境铺陈、内心独白,这些东西读起来很美,但 AI 视频模型看不懂"她心里五味杂陈"该怎么画。第二,小说的节奏太慢了。一本网文动辄几十上百万字,开头往往是慢悠悠地交代背景。你要是照搬,观众刷到三秒就划走了。
我举个通用化的例子。假设一本小说的开头是这么写的:"黄昏时分,夕阳的余晖透过教室的玻璃窗,在地板上投下一道道斜长的光影。"——这句话作为文学描写没问题,但作为一集短剧的开头,它太平了,没有任何抓人的东西。观众凭什么为这样一个开头停下来?
所以,在真正生成画面之前,我们必须先做一件事:把小说"翻译"成一份专门为短剧服务的剧本。而干这个翻译活最趁手的工具,就是大语言模型。
4.2 用大语言模型当你的"编剧助手"
现在能胜任这个角色的大模型有不少,豆包、DeepSeek、Kimi 这些都可以。考虑到很多新手是零基础,我下面就以操作比较友好的豆包为例来讲思路,你换成别的模型,逻辑是一样的。
有一个操作细节值得单独拎出来说:用豆包这类工具处理长文本任务时,尽量选"深度思考 / 专家"这类模式,而不是图快的"快速"模式。快速模式为了响应速度,生成的内容往往比较简单、比较浅;而处理剧本改写这种需要理解上下文、还要有创作发挥的任务,深度模式给出的结果明显更细腻、更贴合需求。这一个选项的差别,有时候比你多写几句提示词还管用。
把整理好的小说文本粘进对话框之后,接下来的重头戏,就是写提示词。
4.3 提示词技巧一:先给 AI 一个"身份"
这是我认为最容易被低估、但性价比最高的一个技巧。
大模型的能力很全面,但正因为太全面,如果你不给它一个明确的定位,它的回答就会四平八稳、缺乏针对性。解决办法很简单:在提示词开头,给它设定一个垂直领域的专家身份。
比如做小说推文剧本,我就会先告诉它"你是一名专业的小说推文改编作者"。你别小看这一句,它相当于给 AI 划定了一个专业赛道——一个深耕推文领域的创作者,对"什么样的文案能留住观众"是有专业直觉的,AI 一旦进入这个角色,输出的东西就会明显更"懂行"。
这个技巧不只在改剧本时有用。后面拆分镜的时候,我会让它当"分镜导演";写标题的时候,我会让它当"资深新媒体运营"。给 AI 派对活儿,先给它派对角色,这是我贯穿整个流程的习惯。
4.4 提示词技巧二、三、四:钩子、留白、做减法
设定完身份,接下来要给 AI 下达具体的改写要求。我通常会强调三件事:
打造爆款开头。 前面说过,平淡的开头是留不住人的。所以我会明确要求 AI 把开头改造成有冲突、有悬念、有信息量的钩子。还是拿刚才那个"夕阳斜照进教室"的例子,一个更抓人的改法可能是先抛出人物的处境或者一个反常的事件,让观众第一秒就产生"这是要发生什么"的好奇。
结尾留悬念钩子。 如果一集的结尾平平淡淡地收掉,观众看完就走了,不会想看下一集。反过来,如果结尾停在一个悬念上——一个没揭晓的真相、一个突然的转折——观众"没看够"的心理就会驱动他继续往下刷。连载能不能做起来,很大程度上就取决于每一集的结尾钩子扎不扎实。
大胆删减无效剧情。 小说篇幅长,里面必然有大量拖沓、平淡、对短剧节奏没有帮助的段落。这些内容如果照搬,只会消耗观众的耐心。所以我会明确授权 AI:"不利于观众停留的情节,可以酌情删减。"该砍就砍,短剧的命脉就是节奏。
把这几点揉在一起,一段可以直接用的剧本改写提示词,大概长这样:
你是一名专业的小说推文改编作者。请把我发给你的这段小说内容,
改写成适配竖屏短剧的推文剧本,要求:
1. 开头打造成强钩子,第一句就要有冲突或悬念,抓住观众;
2. 结尾留一个悬念钩子,让观众想看下一集;
3. 对推进节奏没有帮助的平淡、拖沓情节,可以酌情删减合并;
4. 保留核心剧情和爽点,语言口语化、画面感强;
5. 分段输出,方便后续拆分镜。
把这段提示词和整理好的小说文本一起发给豆包,它就会返回一版优化后的剧本。你会明显感觉到,改过之后的开头,每一句都比原文更有张力、信息密度更高。
4.5 一个心态上的提醒:初稿不是终稿
这里插一句我踩过的坑:千万别把 AI 生成的第一版剧本当成最终稿。
AI 写出来的东西经常会有逻辑断层,或者某些地方发挥得过于文艺、脱离了你的本意。正确的做法是把它当成"初稿",然后针对不满意的地方追问、返修。比如某一段过渡得很生硬,你就单独把这两段拎出来,让它补一个过渡;某个人物的动机交代不清,你就让它专门补一段。这种针对性的小修小补,比你推翻重写整篇高效太多了。
4.6 短剧节奏的底层逻辑:三秒、十秒、结尾
在讲下一步之前,我想再往深挖一层,聊聊改剧本时你心里要有的那把"节奏尺"。因为提示词写得再漂亮,如果你自己不懂短剧的节奏逻辑,也很难判断 AI 给的稿子好不好。
短视频的节奏,我习惯用三个时间节点来把控:
开篇三秒定生死。 观众划到你这条内容,前三秒决定他留不留下。所以第一个画面、第一句台词,必须直接抛出最强的钩子——一个冲突、一个反常、一个悬念,别铺垫、别客套。很多人败就败在开头舍不得删铺垫,结果观众还没等到精彩就走了。
十秒立住人物立场。 三秒抓住注意力之后,接下来大约十秒内,要让观众明白"这是谁、他站在什么立场、他面临什么处境"。人物立场立不住,观众就没有代入感,也就没有继续看下去的理由。
结尾五秒留悬念。 前面说过结尾钩子的重要性,这里再强调一遍它在节奏上的位置——一集的最后几秒,一定要卡在一个"没揭晓"的点上,把观众的好奇心吊起来,自然过渡到下一集。
把这三个节点当成改剧本时的检查表:每改完一版,就回头问自己——开头三秒够不够炸?十秒内人物立没立住?结尾有没有钩子?三个都过关,这份剧本才算合格。这套节奏感,AI 是替你把控不了的,它只能执行,判断得靠你