AI 短剧 / AI 漫剧教程合集整理

 


导读

此合集整理了 11 篇 AI 短剧 / AI 漫剧教程,覆盖三个层次:零基础能照抄的保姆级流程(素材 D、F、G、H)、带具体参数的进阶级实操(素材 B、C、E、J、K)、行业方法论与变现视角(素材 A、F、I)。

三件事你应该先知道:

  1. 角色一致性是生死线。76% 的创作者把”角色变脸”列为第一大痛点(素材 I),素材 H 称其为”漫剧观众流失头号原因”。先锁定角色,再开拍,不要拍完再补。
  2. 流程已经工业化。一体化平台(火山剧创、小云雀、万兴剧厂)能把周期压缩 80% 以上,一部 AI 漫剧全流程 48 小时可出片、算力成本低至 3000 元(素材 A、H)。个人单干仍然可行,成本约几百到数千元。
  3. 内容比工具重要。多篇文章反复强调:AI 写的剧本千篇一律,必须自己改(素材 F);分镜设计与叙事节奏是 AI 替代不了的核心能力(素材 K)。

怎么用这份文档:
– 完全没做过 → 直接跳到 第七章学习路径,按 Day1-Day7 走,配合 第四章模板 复制提示词。
– 已经会做但角色老变脸 → 直接看 第五章角色一致性专题。
– 已有产能想提速 / 降本 → 看 第三章通用 SOP 和 第八章行业数据。
– 想了解能不能赚钱 → 看素材 F 与第八章。


一、教程清单速览表

编号 标题 来源平台 / 发布信息 定位 难度 适合人群 链接
A AI短剧教程:从零开始掌握人工智能短剧创作全流程 塔猴 · AI观察者|2026-08-18 行业级全流程 + 行业数据 ★★★☆☆ 想全面了解赛道、工具选型、平台动态的从业者 https://www.tahou.com/article/214836021472535557
B AI 漫剧导演:用人工智能讲好每一个故事 今日头条 · 火星人教育|约1周前 叙事/导演思维(解决”像幻灯片”) ★★★☆☆ 会生图但组合起来没叙事感的人 https://m.toutiao.com/article/7660392807806304787
C AI短剧制作:从脚本生成到画面渲染的全链路 火星人教育官网|2026-06-14 技术参数最硬核(ComfyUI 节点级) ★★★★★ 愿意折腾本地部署、追求可控性的技术型创作者 https://www.2ds.cn/?p=21002/
D 2025年风口项目:AI漫剧怎么做?这套”傻瓜式”教程请收好 今日头条 零基础最友好入门版 ★☆☆☆☆ 完全零基础、第一次接触 https://m.toutiao.com/article/7595061848358027830
E AI影视漫画怎么做的视频?AI工具帮你搞定剧本、角色、分镜、动态、后期全流程 ChooseAI 搭积木式五块流程 + 工具清单 ★★☆☆☆ 想快速了解”有哪些工具可用” https://www.chooseai.net/news/1067/
F AI漫剧订单暴涨14倍,我拆解了普通人赚钱全流程 今日头条 变现视角 + 四步流程 + 避坑 ★☆☆☆☆ 关心收益、想跑通变现闭环 https://www.toutiao.com/article/7682037576450032168
G AI短剧制作全流程——成本几百块,3天出一部 今日头条 · 帝听听问|2026-07-31 成本/周期视角的极简工作流 ★★☆☆☆ 一个人、小成本、想快速出片 https://www.toutiao.com/article/7668673383726449167
H AI漫剧制作全流程(长文,2026年) 检索自公开内容平台(来源链接缺失) 最详细的零基础保姆级(2D+3D 双赛道) ★★☆☆☆ 想完整照抄一套流程的零基础创作者 来源链接缺失(检索自公开内容平台)
I 7种角色一致性方案 检索自公开内容平台(火星人教育公众号内容,来源链接缺失) 角色一致性专题(方案最全 + 实测数据) ★★★★☆ 被”变脸”卡住的所有人 来源链接缺失(检索自公开内容平台)
J AI短剧·漫剧实战从0到1(系列) 腾讯 ima 知识库收录(具体文章页 URL 不稳定) 实战派七步工作流 + 避坑 ★★☆☆☆ 想按”七步”标准化作业的实操派 https://ima.qq.com/wiki/ (知识库分享页,无精确文章链接)
K 流程|4步做出一部AI短剧(拆解彭青云案例) 腾讯 ima 知识库收录(同上) 极简四步闭环 + 从业者视角 ★☆☆☆☆ 想先看全貌、评估投入产出 https://ima.qq.com/wiki/ (知识库分享页,无精确文章链接)

时效性警告(重要):
– 素材 A 明确记录 Sora 已于 2026 年 3 月被 OpenAI 关停网页端 / App / 开发者服务,当前赛道由国产模型主导。素材 D、K 中仍把 Sora 列为推荐工具,这两篇的工具清单已过时,请以素材 A 为准。
– 素材 B 自述工具链为”2025 年 3 月版”(MJ V6.1、SD WebUI 1.9.4、DaVinci 18.6、Kling 1.5 等),素材 C 使用 Claude 3.5 Sonnet / MJ V6 / Runway Gen-3 Alpha / Kling 1.5。两篇的方法论与参数依然有效,但版本号应替换为当前最新(如 Seedance 2.0/2.5、可灵 3.0)。
– 素材 D 标题写”2025年风口项目”,发布较早,工具建议偏旧,流程思路仍可借鉴。


二、逐篇详解

素材 A|《AI短剧教程:从零开始掌握人工智能短剧创作全流程》

🔗 https://www.tahou.com/article/214836021472535557 |塔猴 · AI观察者|2026-08-18

核心流程(六阶段流水线)

剧本立项 → AI解析 → 人设生成 → 抽卡生视频 → 后期精修 → 成片输出

阶段 关键动作 要点
1 剧本立项 原创 / 改编优质故事 / 平台对接获取 三种剧本来源途径
2 AI解析 内容审核 → 导演监制提取人设、人物关系、场景、冲突点 → 投喂 LLM 生成世界观、人物设定、核心情节、场景道具 先人工审核再投喂 LLM
3 人设生成 生成角色/场景资产 见第五章一致性方案
4 抽卡生视频 批量生成、择优 单次最多 15 秒;三分多钟样片可能抽上百条
5 后期精修 剪辑、配音、调色 —
6 成片输出 导出分发 —

推荐工具链

类型 工具 说明
一站式平台 火山剧创 1.0(字节火山引擎,2026-05-21 上线) 剧本解析→全剧资产设定→分镜视频生成→成片预览;多智能体架构 + Seedance + Seedream;周期缩短 80% 以上
一站式平台 小云雀 AI 短剧 Agent(2026-03-19) 全球首个搭载 Seedance 2.0 的行业智能体;最多上传 10 万字剧本一键出片
一站式平台 AniShort(2026-03) 无限画布、节点化协同创作
一站式平台 万兴剧厂 集成 Seedance 2.0、Vidu Q3、Kling 3.0 4K
一站式平台 咪咕悦创(2026-07) —
视频模型 Seedance 2.0 / 2.5(字节自研,2026-06 发 2.5) 当前主流
视频模型 快手可灵 3.0(2026-06 开放 API) 多镜头角色相似度 95%
视频模型 HappyHorse 1.1(阿里云,2026-06-22) —
视频模型 ~~Sora~~ 已关停(2026-03,OpenAI 关停网页端/App/开发者服务)
剪辑 剪映专业版(2026-06 AI 文字成片升级) 一句话生成脚本 + 匹配画风 + 分镜 + 智能配音
本地工作流 ComfyUI(配 Flux、IP-Adapter、FaceID) 节点式

可直接复制的提示词模板

分镜提示词 8 要素(CBASCLTS):

CHARACTER(角色) + BACKGROUND(背景) + ACTION(动作) + SCENE(场景) + CAMERA(镜头) + LIGHT(光线) + TEXT(文字) + STYLE(风格)

小云雀官方”沉浸式短片黄金公式”:

[主体描述] + [画面运动描述] + [音效互动] + [台词] + [音色描述] + [运镜/环境] + [风格修饰] + [限定信息]

提示词技巧(原文):图像提示词用英文逗号分隔短语,少用中文长句;视频提示词按”镜头1/镜头2/镜头3″顺序组织;必须加 NOT humans 等约束子句避免无关内容。

这篇文章最有价值的一点:它是唯一一篇把一站式平台矩阵(火山剧创 / 小云雀 / AniShort / 万兴剧厂 / 咪咕悦创)和行业供给侧数据(市场规模、上线部数、成本周期、算力成本)完整列出来的,适合用来做工具选型和赛道判断。

适合什么人在什么阶段看:入行前做赛道调研时;以及已在手工流程上跑通、准备切换到一体化平台提效时。


素材 B|《AI 漫剧导演:用人工智能讲好每一个故事》

🔗 https://m.toutiao.com/article/7660392807806304787 |今日头条 · 火星人教育|约1周前

核心观点:AI 漫剧不是连环画

连环画 AI 漫剧
画面 静态图排列 动态
叙事 每图独立叙事 镜头切换、景别变化、节奏控制
核心能力 画师用笔讲故事 导演用提示词和工具调度故事

三个核心概念:
1. 景别连续性 —— 避免相邻镜头同景别,否则产生”跳帧感”
2. 动作连贯性 —— 相邻帧动作有逻辑承接(抬手→握拳→挥出)
3. 情绪递进 —— 用光影、色彩、构图引导情绪

痛点数据:火星人教育统计,过去三个月超 70% 学员卡在”从图像到叙事”的跃迁。

推荐工具链(原文标注为 2025 年 3 月版)

环节 工具 参数/说明
图像生成 Midjourney V6.1 --style raw --v 6.1 --s 250
图像生成 Stable Diffusion WebUI 1.9.4 + ControlNet 1.1.4 —
角色一致性 SD 插件 ReActor v0.6.1 / MJ --cref —
分镜剪辑 DaVinci Resolve 18.6(免费版即可)/ CapCut 3.8.0 —
语音 ElevenLabs(TTS 模型 v2)+ Adobe Audition 2024 中文推荐 Rachel / Adam 语音,导出 WAV

可直接复制的提示词模板

① 角色参考图:

a young woman, 25 years old, short black hair, wearing a beige trench coat, photorealistic, cinematic lighting --ar 2:3 --v 6.1

② 用提示词控制”虚拟摄像机”:

目的 提示词
低角度仰拍 low angle shot, looking up + --ar 9:16
过肩镜头 over the shoulder shot, focus on subject + --iw 2
主观视角 POV shot, first person view, hands visible in frame
航拍俯视 top-down view, bird's eye perspective + --ar 16:9

③ 情绪色彩系统:

情绪 提示词
紧张 cold blue and gray palette, high contrast, harsh shadows
回忆 sepia tone, warm glow, soft focus, film grain
反转 sudden burst of red, dramatic lighting, rim light

④ 让 AI 理解镜头语言(对比示例):

❌ 一个人走路
✅ medium shot, tracking shot, man walking down corridor, dust particles in light, cinematic depth of field

SD + ReActor 角色一致性实操参数(耗时约 1 小时)

项目 参数
大模型 Realistic Vision V5.1 或 DreamShaper 8
ControlNet Canny 模式,权重 0.8
ReActor 上传参考图,勾选 Enable,Face swap 模式
批量 Batch 一次 4-6 张选最佳
采样 Steps: 30, CFG Scale: 7, Sampler: DPM++ 2M Karras
提示词一致性 每镜保持角色描述一致:same woman, short black hair, beige trench coat

动态化参数(DaVinci Resolve 18.6 + 免费插件 Keyframe Assistant,约 2 小时)

项目 参数
Ken Burns 效果 Inspector→Transform,缩放 100%→105%(缓慢推进),位置偏移不超过画面 10%
转场 Cross Dissolve 0.3-0.5 秒;相邻镜头景别不同时用 Dip to Black
环境音效 Freesound.org 下载,Audition 做 5 秒循环,音量 -18dB

叙事节拍(节奏控制)

场景类型 每帧停留 转场
对话 3-5 秒 + 缓慢推拉 —
动作 1-2 秒 + 快速缩放/滑动转场 —
悬念 关键帧 6-8 秒 + 环境音效渐强 DaVinci Speed 工具(如 50% 慢放)

案例结构参考(3 分钟悬疑漫剧《深夜图书馆的脚步声》)

三幕式:铺垫 30 秒 → 冲突 2 分钟 → 反转 30 秒;拆 12-15 个分镜,每镜标注景别、角色表情、环境氛围。

镜号 景别 画面 声音
1 全景 深夜图书馆走廊,昏黄灯光 脚步声渐强
2 中景 主角背影,手电筒光晃动 呼吸声
3 特写 主角惊恐表情,汗珠滑落 “谁在那里?”

这篇文章最有价值的一点:“用提示词控制虚拟摄像机”和”情绪色彩系统”这两张表。绝大多数教程只教怎么生成好看的图,这篇教你用电影语言调度画面——这是”100 张图组合起来像幻灯片”和”一条能看的漫剧”之间的真正差距。

适合什么人在什么阶段看:已经能稳定出图、但成片”没感觉”的人。建议在跑通第一版流程后立刻回来看这篇。


素材 C|《AI短剧制作:从脚本生成到画面渲染的全链路》

🔗 https://www.2ds.cn/?p=21002/ |火星人教育官网|2026-06-14

核心链路五环节

结构化脚本 → 参数化提示词 → 角色一致性控制 → 动态帧生成 → 后期合成

原文强调:角色一致性是瓶颈,也是专业与业余的分水岭。
常见错误:让 AI 直接写完整剧本再”翻译”成画面 → 画面台词脱节,因为语言模型不理解”视觉节奏”。正解是分步生成。

第一步:分镜级脚本(Claude 3.5 Sonnet,推荐 2024 年 8 月后版本)

请扮演一位资深短剧编剧。我需要一个30秒的悬疑类短剧,主题是"镜中人的秘密"。请按以下格式输出:
[场景编号] – [时长] – [镜头类型]
画面描述:[用30-50字精确描述人物动作、表情、环境光效]
台词/旁白:[不超过20字]
音效提示:[如:滴水声、心跳声、关门声]
要求:每个场景的画面描述必须包含"可视觉化的动作",例如"手指颤抖着触碰镜面"而非"感到害怕"。

输出示例:

[SCENE 1] - 5s - 特写
画面描述:深夜浴室的冷白色灯光下,一只颤抖的手缓慢伸向布满水雾的镜子。指尖在镜面上划出一道弧线,水珠顺着手指滑落。
台词:旁白:"你相信镜子里的自己,会先开口说话吗?"
音效提示:水滴声,低频嗡鸣

关键参数:每场景 3-8 秒;30 秒短剧建议 6-8 个场景;镜头类型只用”特写/中景/全景”,避免复杂运镜。

第二步:参数化提示词(MJ V6)

A hand with visible veins trembling, reaching toward a fogged mirror, cold white bathroom light, condensation droplets on glass, shallow depth of field, cinematic lighting, horror atmosphere, shot on Arri Alexa 35 --ar 16:9 --style raw --s 250 --v 6
参数 说明
--ar 16:9 短剧标准画幅
--style raw 减少过度美化
--s 250 风格化(悬疑类建议 200-300)
--v 6 版本

第三步:ComfyUI(v0.2.7)+ InstantID + IP-Adapter

节点 作用 参数
InstantID 固定角色面部特征 上传主角正脸照(纯色背景、正面光照均匀);weight=0.8,start_at=0,end_at=0.4。weight 太高会面部僵硬,0.8 是平衡点
IP-Adapter 保持画面风格一致(色调/光影/质感) 上传第一帧生成图作风格参考;用 plus face 模型;scale=0.6。短剧建议 0.5-0.7

工作流搭建:
1. 基础模型 Realistic Vision V5.1(写实类首选)
2. KSampler:步数 30、CFG Scale 7.5、采样器 DPM++ 2M Karras
3. InstantID 和 IP-Adapter 接到 KSampler 正面提示词输入
4. batch_size=4 每次生成 4 帧择优

实操案例(”穿黑色风衣的侦探”3 场景:雨中低头行走全景 / 抬头看向路灯中景 / 眼神特写):

❌ 错误:每场景单独写提示词,不引参考图
✅ 正确:
   ① 先出正脸图作 InstantID 输入
   ② 每场景提示词结尾加 –iw 0.8 –no deformed face, weird eyes
   ③ 场景2、3 除引用正脸图外,还引用场景1输出图作 IP-Adapter 风格参考

第四步:动态化两条路径

路径 A:Runway Gen-3 Alpha 路径 B:Kling 1.5
适用 5 秒内短片段 长镜头,最长 10 秒
操作 上传静态首帧 → 运动描述 → Motion Scale=5(短剧建议 3-6)、End Frame=0 上传关键帧 → Duration=5、Mode=Standard
提示词 "The character slowly turns head, rain drops on coat, subtle camera push-in" "walking in rain, wet pavement reflection, cinematic depth of field, slow motion"
后期 Topaz Video AI 做 4K 超分和补帧(60fps,模型 Artemis) 剪映专业版做音画同步剪辑
注意 不要超过 5 秒否则扭曲,建议每段 2-3 秒后期拼接 物理规律模拟更好,走路、风吹衣摆更自然

后期合成:音效不要只用 BGM(用 Epidemic Sound / Artlist 搜具体音效,叠加两层音轨);转场避免硬切,用 Filmora 或 DaVinci 的溶解转场 0.3-0.5 秒;字幕手动润色后用 ArcTime 或剪映智能字幕。

FAQ 要点(原文)

问题 解法
MJ”网红脸”无辨识度 加具体特征:a middle-aged man with a scar on left eyebrow, tired eyes, five o'clock shadow;把 --s 降到 200 以下;或用 InstantID 固定有辨识度的人脸
动作”抽搐” 检查源帧清晰度;Runway/Kling 把 Motion Scale 降到 3-4;CFG Scale 提到 7-8;动作描述保持”单一动作”
多场景风格统一 IP-Adapter 的 style reference 模式,scale 统一 0.6;所有场景 negative prompt 保持一致;推荐加 "cartoon, anime, 3D render, low quality, blurry"
8G 显存跑 ComfyUI 用 --lowvram 启动;选 SD 1.5 而非 SDXL;batch_size=1;尺寸 512×512(后期 Topaz 超分);或 Google Colab Pro 的 V100(约 10 美元/月)

进阶方向:AnimateDiff(更流畅动画,非写实风格);ElevenLabs 语音克隆(给主角定制专属声音);GPT-4o 视觉分析(自动检测画面是否符合脚本)。

这篇文章最有价值的一点:InstantID weight=0.8 / start_at=0 / end_at=0.4 + IP-Adapter plus face scale=0.6 这组可复现的节点级参数,以及”动作抽搐 → 降 Motion Scale 到 3-4、提 CFG 到 7-8″的调参路径。这是唯一一篇给出完整 ComfyUI 数值的文章。

适合什么人在什么阶段看:本地部署 / ComfyUI 用户;以及对画面可控性要求高、愿意为质量花时间调参的人。


素材 D|《2025年风口项目:AI漫剧怎么做?这套”傻瓜式”教程请收好》

🔗 https://m.toutiao.com/article/7595061848358027830 |今日头条

三大块:分镜 / 动画 / 发布

① 分镜制作 —— 视频的”设计图”,像画连环画。

项目 内容
常用工具 即梦、Nano banana pro、seko
操作步骤 ① 喂素材:上传剧本、角色图、场景图 ② 排顺序:1 分钟视频准备 5-8 张分镜图(太多太赶、太少无聊)③ 加说明:标注景别(近景/全景)与运镜(推近/拉远/左右移)
新手窍门 觉得从零生成难 → 先做一张满意的图,再让 AI 基于这张图生成连续后续画面,风格更统一
收尾 给每张分镜图编号

提示词万能公式:

【场景环境】+【角色动作】+【镜头描述】
❌ 反例:猫在桌子上
✅ 正例:教室全景(场景+镜头),一只猫跳上了书桌(角色动作)

② 动画生成

项目 内容
国际工具 ~~Sora~~(已关停,见素材A)、Runway、Pika
国产工具 Vidu、即梦(Jimeng)、可灵(Kling)、海螺(Hailuo)
选型建议 选一两个顺手的即可
做法 上传分镜图 + 角色素材 → 先从一个镜头开始生成 → 微调动作细节 → 加基础转场(淡入淡出、切换)
检查三件事 ① 走路是否顺、脚有没有”飘” ② 说话时表情是否对应情绪 ③ 转头抬手是否连贯
关键技巧 尽量用同一个工具完成同一条视频,混用容易”风格割裂”

这篇文章最有价值的一点:“1 分钟视频准备 5-8 张分镜图”这个量化基准,以及“同一条视频尽量用同一个工具完成”——后者是被很多教程忽略但极其实用的经验。

适合什么人在什么阶段看:完全零基础的第一天。读完这篇就能动手做出第一条。


素材 E|《AI影视漫画怎么做的视频?AI工具帮你搞定剧本、角色、分镜、动态、后期全流程》

🔗 https://www.chooseai.net/news/1067/ |ChooseAI

五块积木:剧本 → 角色 → 分镜 → 动态 → 后期

① 剧本生成

  • 工具:ChatGPT、豆包AI、Anime AI
  • 结构化提示词:故事类型 + 核心冲突 + 角色设定 + 场景关键词
热血校园剧,转学生发现同学是外星人,男主戴黑框眼镜,女主有猫耳,场景包含教室、天台、秘密基地
  • 分镜细化用 镜头语言 + 动作描述:
中景:男主推眼镜,逆光下镜片反光,女主猫耳突然竖起(镜头右移展示窗外UFO轮廓)

② 分镜生成

步骤 工具 说明
1 StoriaBoard 输入文本自动识别场景角色,生成带运镜建议的分镜草图
2 MidJourney 选中关键画面生成高清版。提示词公式 角色动作+场景细节+风格参数+镜头语言,例:”女主手持激光剑跃起,火焰在身后燃烧,赛博朋克风格,低角度仰拍突出气势”
3 即梦AI 给静态分镜加”镜头平移””变焦”,生成 30 秒动态预演

③ 角色设计

步骤 工具 说明
1 Comicai 上传参考图 + 特征描述(如”18岁少女,银发双马尾,机械义眼,战斗服带齿轮装饰”),生成多套方案
2 即梦AI 一致性控制:保存角色参数(肤色、发型代码)确保跨场景统一;崩图用”局部重绘”修正
3 AnimeShorts 输入”女主惊讶”自动生成口型同步、瞳孔收缩的表情动画

④ 场景搭建

工具 用途
通义万相 复杂场景生成(如”末日废土城市,摩天大楼倾斜,天空呈现紫色电离层”,带粒子特效的全景图)
巨日禄 场景复用——批量生成同一场景不同角度(教室全景→黑板特写→窗外远景)
Runway ML —

这篇文章最有价值的一点:工具清单最丰富且按”积木”分类,尤其是 StoriaBoard(自动分镜草图)、Comicai(角色方案)、巨日禄(同场景多角度批量)——这三个工具在其他教程里都没出现,是很有价值的补充。

适合什么人在什么阶段看:想扩充工具箱、或某个环节卡住想换个工具试试时。当作”工具黄页”查即可。


素材 F|《AI漫剧订单暴涨14倍,我拆解了普通人赚钱全流程》

🔗 https://www.toutiao.com/article/7682037576450032168 |今日头条

四步流程 + 变现

① 选题:团宠、种田、古风爽文、穿越逆袭——短剧榜靠前的基本是这些。

② 写剧本(豆包或 DeepSeek,免费):

帮我写一个古风种田漫剧的3分钟脚本,主角是穿越成弃妇的现代女医生,她在边疆开荒种地,靠医术逆袭。分3集,每集结尾留悬念。

几分钟出完整剧本(含分镜描述、角色设定、场景安排)。

坑:AI 写的剧本千篇一律,直接用很难爆,必须自己改——加反转、改台词、调节奏。AI 是出初稿的,不是替你做决定的。

③ 生成画面(即梦AI 或 可灵AI,免费):

古风女子在田间劳作,远处是边关城墙,夕阳西下

几十秒出 4 张图选最好的。3 分钟漫剧约需 15-20 张图,熟练 1 小时生成完。实测第一次生成 5 张图只有 2 张质量不错——别指望一次到位。

④ 配音剪辑(剪映,免费):

  • 导入图片,用”关键帧”功能做缓慢推拉效果
  • 剪映自带 AI 配音
  • 字幕一键识别
  • BGM 从剪映音乐库选
  • 只需会用”导入””分割””加字幕”三个功能

⑤ 发布与收益

平台 特点
抖音 开通创作收益权限后播放量直接换钱;S+ 级漫剧有保底 75 万播放量扶持
快手 —
红果短剧 分成比例高,新人有激励奖金
视频号 —

发布打标签:#AI漫剧 #短剧 #AI创作

坑一:万播收益在跌。早期百万播放收益几百块,现在同样播放量可能只有几十块——做的人多了、分钱的人多了。但头部创作者月入十万的例子仍在,关键在内容质量。

这篇文章最有价值的一点:“3 分钟漫剧约需 15-20 张图、熟练 1 小时生成完”和”剪映只需会三个功能”——这两句话把门槛从”看起来很高”直接拉到”今晚就能做完”。同时它诚实地指出了万播收益在跌。

适合什么人在什么阶段看:想评估”这事值不值得干”以及”最短路径是什么”的人。


素材 G|《AI短剧制作全流程——成本几百块,3天出一部》

🔗 https://www.toutiao.com/article/7668673383726449167 |今日头条 · 帝听听问|2026-07-31

成本是真人剧的 1/5 到 1/4,制作周期从天级压到 3 天,一个人跑完全流程。

工具链(按环节分工)

环节 工具 作用
分镜 + 日常动作 即梦AI(Seedance 2.0) 文字转视频,自动分镜 + 推拉摇移
特效 + 高动态镜头 可灵 Kling 水流/烟雾/爆炸/武侠打斗,原生 1080P/4K
音画同步 通义万相 Wan2.5 自动匹配音效、人声、口型
剪辑 + 配音 + 字幕 剪映 和即梦AI 深度打通,一键剪辑

3 天流程

天 任务 细节
Day 1 剧本 + 分镜 ChatGPT 写剧本 30 分钟出故事;即梦AI 生成每镜头画面
Day 2 生成视频素材 日常动作用即梦;特效镜头用可灵(视频续写最长 2 分钟);数字人对白用通义万相
Day 3 剪辑 + 发布 素材导入剪映自动加字幕配音、调节奏加 BGM、导出成片

分发渠道:红果短剧(流量最大、平台分成)、央视频(权威背书)、安徽卫视等卫视(上星播出、品牌溢价)。

变现路径:平台播放分成;品牌定制短剧(一条收 3000-10000 元);带货植入。

这篇文章最有价值的一点:“按环节分工具”的思路——不追求一个工具干完所有事,而是日常动作/特效/音画同步各用最擅长的工具。同时给出了品牌定制短剧 3000-10000 元/条的定价参考。

适合什么人在什么阶段看:已经跑通一遍、想压缩周期到 3 天的人。


素材 H|《AI漫剧制作全流程》(长文,2026年)

⚠️ 来源链接缺失(检索自公开内容平台)

这是本合集中最详细的零基础保姆级教程,含 2D 漫剧与 3D 仿真人双赛道。

概念与市场

  • AI 漫剧 = 用 AI 把文字剧本转成连贯漫画画面 + 配音字幕动态特效
  • 与真人短剧区别:画面是 AI 生成的漫画风格;与传统漫画区别:画面是动态的
  • 主流画风三种:日系动漫风、国漫厚涂风、韩系半写实风
  • 新手建议从日系动漫风入手——对 AI 生成容错率最高、角色一致性最好控制

赛道对比

2D 二次元漫剧 3D 仿真人短剧
题材 古风、系统流、校园甜宠 豪门逆袭、悬疑复仇
单集耗时 30-45 分钟 50-70 分钟
成本 低(免费工具可完成) 中等(数字人工具需会员)
受众 学生、网文爱好者,流量更大 成年用户,短剧分销收益更高
难度 低,画风容错率高 中,需把控光影和人物一致性
适合题材 系统流/穿越/玄幻/校园 豪门/复仇/都市/悬疑

传统动画团队一集需 3-7 天,AI 流水线压缩至 60 分钟单集成片。

七步流程

第一步 剧本创作

新手最大误区:一上来就打开绘图工具。画面依附故事。
AI 漫剧剧本更依赖旁白驱动(漫画画面表现力有限,心理活动、场景转换、时间跳跃靠旁白衔接)。
单集建议 60-90 秒、8-12 个镜头。

你是一位资深AI漫剧编剧,擅长快节奏、强情绪的竖屏漫剧创作。
【题材】:______(如:古风复仇/都市甜宠/悬疑推理)
【核心设定】:______(一句话概括故事核心矛盾)
【主角】:姓名/年龄/身份/性格/核心欲望
【集数与时长】:共__集,每集60-90秒,8-12个镜头
创作要求:
每集前10秒必须有强钩子(冲突/反转/悬念)
每集结尾必须留悬念,引导看下一集
旁白占比40%,对白占比60%,旁白用于心理活动和场景过渡
对白简短有力,单句不超过15字
每集至少1个情绪转折点
输出格式:集数 + 场景 + 人物 + 动作 + 对白 + 旁白

工具:豆包、DeepSeek、Kimi。第一版出来后重点检查三件事:人物关系是否清晰、冲突节奏是否够密、旁白与对白比例是否合理。不满意就逐段修改,不要整段重写。

第二步 角色与场景资产(90% 新手翻车的地方)

每个核心角色需要:正面定妆照(胸像)、侧面照、全身照、角色三视图(正面+侧面+背面)、2-3 个关键表情。

【角色名】:苏晚
【年龄】:22岁
【画风】:日系动漫风格,赛璐璐上色
【外貌】:鹅蛋脸,琥珀色大眼睛,长睫毛,小翘鼻,樱花色嘴唇
【发型】:银灰色长直发,齐刘海,发尾微卷
【服装】:白色古风长裙,腰间系蓝色丝带,袖口绣银色花纹
【体型】:身高165cm,纤细
【性格关键词】:清冷、坚韧、内心柔软
【配饰】:左耳戴一枚蓝色耳坠

工具:即梦、Midjourney、LiblibAI。选定最满意的一张作”基准图”,后续所有镜头以它为参考。进阶:训练角色 LoRA 或用 IP-Adapter、InstantID 把特征”焊死”。场景同理,核心场景也先出一张”基准场景图”。

第三步 分镜拆解

合格漫剧分镜需包含:景别、人物动作与表情、镜头运动、环境氛围、对应台词或旁白。

三个关键原则:
1. 复杂动作拆成多格 —— “角色拔剑挥砍”拆成:手按剑柄特写→拔剑中景→挥砍近景→对手后退全景;每镜头 3-5 秒,比一个长镜头稳定得多
2. 情绪用特写放大 —— 愤怒给眼睛特写,悲伤给嘴角颤抖特写,比中景更有冲击力
3. 旁白对应空镜 —— 飘落花瓣、移动云影,不浪费角色资源又营造氛围

你是一位资深漫画分镜师,请将以下剧本段落拆解为分镜头脚本。
【剧本段落】:______
【角色基准】:______(粘贴角色设定)
【场景基准】:______(粘贴场景设定)
【画风】:日系动漫 / 国漫厚涂 / 韩系半写实
每个分镜输出:镜号 / 景别(特写/近景/中景/全景/远景)/ 画面描述(人物动作+表情+构图+环境细节)/ 镜头运动(固定/缓慢推近/平移/缩放)/ 时长(秒)/ 对应台词或旁白 / 音效提示
要求:每个镜头3-5秒,单镜头动作单一明确,情绪节点用特写强调。

分镜拆得越细,后面返工越少,这一步花的时间后面能省回三倍。

第四步 画面生成(先静后动)

核心原则先静后动——先生成每镜静态关键帧确认无误再做动态化。直接文生视频可控性太低,不建议新手使用。

工具 特点
即梦 中文理解好、国风质量高、免费额度足
Midjourney 画风多样质感顶级,但需科学上网
LiblibAI 国内、模型丰富、支持 LoRA 训练
Stable Diffusion(本地) 自由度最高

三个技巧:① 用基准图做参考,提示词加”保持角色形象一致” ② 统一画风后缀,每条提示词末尾固定加画风描述(如”日系动漫风格,赛璐璐上色,干净线条,柔和光影,高画质”)③ 批量生成择优,每镜生成 4-8 张备选

第五步 动态化

方案 工具 操作
方案一:AI 图生视频(推荐) 可灵、即梦视频、Vidu、Pika、Runway 上传静态图 → 输入运动描述(如”人物缓慢转头,眼神从冷漠变为惊讶,镜头缓慢推近”)→ 生成 3-5 秒片段
方案二:剪辑软件做简易动态(零成本) 剪映 给静态图加关键帧动画:缓慢缩放(110%→100% 模拟推镜)、缓慢平移(模拟摇镜)、加抖动转场增强节奏

方案二是”伪动态”,不如 AI 自然但零成本零门槛,适合试水。
逐个检查:动作是否自然、有无畸形穿模、镜头运动是否流畅。

第六步 配音配乐与后期

漫剧的情绪张力至少一半来自声音。同样画面配平淡 AI 朗读和有情绪起伏的配音,完播率能差一倍。

项目 做法
工具 剪映AI配音、豆包语音合成、ElevenLabs
音色 旁白用沉稳音色,对白按角色性格选音色
语速 调至 0.9 倍更自然
语气 关键台词加重语气,不要全程平铺
配乐 古风剧:古筝+笛子;甜宠剧:钢琴+弦乐;悬疑剧:低频电子音
BGM 音量 控制在人声的 20%-30%
音效 拔剑声、脚步声、风声、心跳声(可用豆包音效生成)
剪辑 全程硬切不要淡入淡出;每 3-5 秒一个镜头切换
字幕 黑体、字号适中、加描边;旁白与字幕严格对齐

第七步 发布与数据迭代

数据 阈值 诊断
3 秒完播率 < 50% 开头钩子不够硬
整体完播率 < 30% 节奏有问题
互动率(点赞+评论+转发) < 3% 情绪共鸣不够

平台:抖音(流量最大,主阵地)、快手、红果漫剧(字节专门的漫剧平台,有付费分成机制)、小红书。

评论区是金矿——观众在猜什么剧情、喜欢哪个角色、吐槽哪里不合理,都是下一集创作方向。

2D 专用提示词模板

角色基准图:

古风少女,清冷五官,白色汉服,长发束起,8K超清,国漫二次元,柔和天光,干净背景,全身立绘,三视图(正面、侧面、背面),统一五官特征,无畸变

即梦上传三视图锁定角色 ID,后续分镜自动复用面部特征。

2D 动态漫动作指令:

镜头缓慢向前推进,女主抬头落泪,发丝随风飘动,衣服轻微起伏,自然眨眼,10秒动态,流畅动画,无闪烁崩坏

转场处理:镜头切换中间生成过渡片段。

3D 仿真人:即梦3D片场、可灵3D数字人(自带灯光机位虚拟场景);专业量产用硅基智能、HeyGen、Seedance 2.0(锁定真人数字人,百集不换脸);动态视频用 Pika 3.0、Runway Gen3(3D 镜头推拉环绕、人物自然动作)。口型同步:提前导入本镜台词音频,AI 自动匹配嘴唇开合。

通用提示词结尾(直接粘贴):

8K 超清,电影级光影,细节拉满,无畸形五官,无扭曲肢体,画面干净,竖屏 9:16,PBR 材质,细腻纹理,景深虚化

网文转短剧提示词(可直接复制)

你是专业竖屏漫剧编剧,将下面小说章节改编为60-90秒单集剧本,遵循爆款结构:
0-3秒强冲突钩子,中段快速推进剧情,结尾留反转悬念;
拆分为8-12个镜头,每个镜头标注:序号、景别、运镜、画面描述、人物台词、时长;
区分2D古风漫剧/3D写实仿真人两种画面描述,文字简洁适配AI绘图,删除冗余心理描写。
小说原文:【粘贴你的网文内容】

7 天落地路线

Day 任务
Day1 赛道定位 + 领番茄免费网文IP + 拆解 3 部对标爆款
Day2 练 AI 写分镜脚本
Day3 2D 角色生成 + 锁定不换脸
Day4 3D 仿真人捏人 + 3D 片场机位灯光
Day5 图生视频批量生成,解决闪烁畸形
Day6 配音音效剪辑全流程,产出第一版粗片
Day7 调色封面优化 + 发布复盘 + 固化个人 SOP

版权合规:优先走官方授权渠道(抖音创作者中心→短剧版权中心,番茄百万网文 IP 免费申请改编),无授权小说禁止商用发布。

这篇文章最有价值的一点:“先静后动”原则和”基准图”工作流,加上三个可诊断的数据阈值(3秒完播率 50% / 整体完播率 30% / 互动率 3%)。它还第一次明确指出”直接文生视频可控性太低,不建议新手使用”——这条能帮新手省下大量无效抽卡。

适合什么人在什么阶段看:这是本合集的主线教程,零基础应该以这篇为骨架,其他篇作为补充。


素材 I|《7种角色一致性方案》(专题长文)

⚠️ 来源链接缺失(检索自公开内容平台,火星人教育公众号内容)

痛点数据:76% 的 AI 短剧创作者把”角色变脸”列为第一大痛点。

为什么会变脸(三句话):

  1. 随机种子不同 → 结果不同:AI 视频生成模型是无状态的,每次生成独立运行,不保留角色记忆
  2. 描述模糊 → 结果不同:”年轻女性”有无数种长相
  3. 场景变化 → 结果不同:光线角度一变,模型重新”理解”角色

7 种方案(按难度从低到高)

# 方案 一致性与门槛 核心做法 优点 缺点 适用场景
1 图生视频参考图驱动 高 / 低 先出角色定妆照,后续所有镜头以它为参考,提示词只写动作和场景 一致性最高、操作最简单、无需技术基础 动作和角度受参考图限制,侧面/远景匹配度约 55% 新手起步、正面镜头为主的短剧
2 角色卡片 + 外貌锚点 中高 / 低 建立固定角色文字档案,每个镜头提示词开头粘贴完全相同的角色描述段落 灵活度高、不受参考图限制、零成本 一致性不如图生视频,细节有偏差 需要多角度、多场景
3 固定种子值 中 / 低 可灵 API 等支持 seed 参数的平台设固定种子值,同场景多镜头共用 简单 种子能提高相似性但不能替代参考图,场景动作变化大时人物仍会漂移 同场景批量生成,作辅助手段叠加
4 AI 换脸后期处理 极高 / 中 生成时不管一致性,后期统一用 AI 换脸工具把所有镜头角色面部替换为同一张脸(ReActor / InstantID) 一致性极高、生成阶段零额外成本 需额外后期步骤,换脸不自然需二次修复 对话密集型短剧、已拍完需补救、Veo3 后期统一
5 LoRA 角色模型训练 最高 / 高 20-50 张不同角度/表情/光线的角色照片,用 Kohya 训练(推荐 rank 32-64),生成时加载 LoRA,strength 0.7-1.0 一致性最高(0.90+),训练一次终身受益 每角色 5-8 小时训练;过拟合则僵化、欠拟合等于没训 长期 IP 运营、固定角色反复使用、有技术团队的工作室
6 ComfyUI IP-Adapter 多视图工作流 高 / 高 IP-Adapter FaceID + 角色 LoRA + ControlNet 三重锁定 灵活度最高、控制最精细、天花板最高 搭建 2-3 天,需 12GB+ 显存和 ComfyUI 经验 专业工作室、对可控性要求极高
7 全流程管线角色引擎 高 / 中 在模型外层包一层角色管理系统,由系统”记住”角色信息,每次调用自动注入角色约束(代表平台 LumenLine 等) 设定一次贯穿全剧、零训练时间、可跨项目复用 参数颗粒度不如 ComfyUI 自建、依赖平台生态 无代码基础、月产 1-2 部

方案 1 定妆照提示词(可直接复制)

Portrait photo of a young Chinese woman, 25 years old, oval face, long straight black hair past shoulders, small mole below left eye, white silk blouse, gentle confident expression, studio lighting, clean background, front-facing

方案 2 外貌锚点示例(可直接复制)

角色C01,25岁亚洲女性,鹅蛋脸,杏仁眼,右眼下方浅色小痣,黑色齐肩直发,三七侧分,银色圆形耳环

⚠️ 注意:不要把”齐肩直发”改成”中长发”,不要交替使用”清秀””妩媚”等主观词——每个词都会导致模型重新推断面部。

方案 5 LoRA 训练数据要求:正面、左右侧面、¾侧脸、不同表情、不同光线,越多样越稳定。

方案 6 参数调节参考

目标 IP-Adapter FaceID 角色 LoRA ControlNet
默认配置 weight 0.75 strength 0.8 OpenPose
面部精度优先 0.9 0.6 —
自然变化优先 0.7 0.8 —
特定姿态 0.75 0.8 0.8-1.0

实测数据对比(16 集短剧 / 400 镜头)

方案 一致性得分 设定耗时 技术门槛
参考图 0.67 约 10 分钟 低
LoRA 微调 0.91 约 7 小时 高
管线引擎 0.88 约 30 分钟 低
ComfyUI 自建 0.90 约 3 天 极高

4 个辅助技巧

技巧 做法
① 服装锚点法 固定服装让观众凭服装识别同一角色。为每场景设定固定服装编号(如 C01-A 日常 / C01-B 夜景),分镜表直接填编号
② 快速剪辑法 每镜头 2-4 秒快速切换,观众来不及观察面部差异;双人对话用正反打分别生成
③ 统一调色法 色调差异会放大不一致感,全片统一后期调色
④ 剪辑过渡法 面部差异大的镜头避免连续放置,中间插入环境空镜或他人反应镜头过渡

按人群选型建议

你的情况 推荐方案
新手第一次做短剧 方案 1(图生视频)
对话密集型 方案 1 + 方案 4(换脸)
月产 1-2 部、无代码基础 方案 7(管线引擎)
月产 3 部+、有技术团队 方案 5 + 方案 6(LoRA + IP-Adapter)
固定 IP 长期运营 方案 5(LoRA 训练)
已拍完需补救 方案 4(换脸)

核心结论:角色一致性是 AI 短剧的”生死线”——观众能接受画面略差,但主角突然换人立刻出戏。先锁定角色再开拍,不要拍完再补。

这篇文章最有价值的一点:唯一的量化横评(一致性得分 / 设定耗时 / 门槛三维度实测),让你能按自己的产能和技术水平直接选型,而不是凭感觉试错。


素材 J|《AI短剧·漫剧实战从0到1》系列

🔗 腾讯 ima 知识库收录(https://ima.qq.com/wiki/ ,具体文章页 URL 不稳定,未编造精确链接)

七步工作流

步 环节 要点
① 写剧本 豆包或 Claude;结构”钩子—发展—反转—收尾“;单集 500-1200 字;题材选市场验证过的——末世、甜宠、悬疑、修仙
② 拆分镜表 每段标注:段号、画面内容、对白、景别、运镜、情绪;一段一个主动作
③ 定角色设定图 即梦或 NanoBananaPro 生成,锁定种子值
④ 写提示词 公式见下
⑤ Seedance 2.0 逐段出视频 9:16 竖屏;上传角色参考图锁脸;每段出 3-5 条挑最好的
⑥ 剪映拼接 按分镜顺序,硬切为主;加配音 BGM 字幕
⑦ 发布 红果短剧、抖音、快手,哪个有扶持先投哪个

提示词公式

主体 + 动作 + 场景 + 光影 + 镜头语言 + 风格 + 画质 + 约束

每段重复风格词画质词;角色段加”同一角色,服装一致,发型不变“。

关键提醒(原文)

  • AI 短剧爆款几乎都是网文 IP 改编,因为故事本身经过千万读者市场验证;原创前先去番茄小说看什么题材在火。
  • 角色一致性反复检查,每段都要引用同一张参考图。
  • 镜头时长会失控——剧本写 3 秒,工具可能自动补成 10 秒 15 秒,成片时长翻倍,只能后期手剪。
  • 别一上来追求完美,先用 huobao-drama 这类全自动工具跑通一遍,再逐环节优化。

行业观察(原文)

重庆某从业者称其认识的近 10 家短剧公司里还在做真人实拍的只剩两三家,有一家直接砍了导演岗位全转 AI。
窗口期有保质期——平台还在砸钱扶持、工具还在迭代、审核细则未完全落地;等头部内容工厂产能拉满、平台补贴退潮、监管收紧,单打独斗的空间会快速收窄。

这篇文章最有价值的一点:“镜头时长会失控”和”先用全自动工具跑通一遍再逐环节优化”这两条。前者是新手最容易懵的地方(写 3 秒出 15 秒),后者是最高效的学习路径。


素材 K|《流程|4步做出一部AI短剧》(拆解彭青云案例)

🔗 腾讯 ima 知识库收录(https://ima.qq.com/wiki/ ,具体文章页 URL 不稳定,未编造精确链接)

4 步闭环:AI生成剧情 → AI生成视频 → AI配音 → 全网分发

工具链总成本约 2000~5000 元/月,一个人即可完成。

步 工具 耗时 关键
1 AI 生成短剧剧本 ChatGPT / Claude 一部剧本约 1~3 天 创意 + 审美是核心能力,AI 只是把想法变成文字
2 AI 生成视频画面 可灵AI / 即梦AI(国产)+ Midjourney(角色图/分镜)+ ~~Sora~~(特效场景,已关停) — 先 MJ 出角色概念图 → 再可灵/即梦生成动态视频 → ~~Sora~~ 做特效。分镜设计和叙事节奏决定短剧质量,这是 AI 替代不了的核心能力
3 AI 配音 + 数字人 HeyGen / D-ID(数字人)+ 剪映AI(配音/字幕) — 出海短剧需要多语种配音,AI 配音成本接近零
4 全网分发 — — —

从业者原话

“以前在开放式办公区接受任务分发,现在在小隔间里掌握项目全流程。虽累但’掌控’。”

这篇文章最有价值的一点:2000~5000 元/月的工具链成本基准,以及”创意+审美是核心能力”的定位——它把这件事的本质说清楚了:AI 是产能杠杆,不是创意替身。


三、横向整合:一条通用的 AI 短剧 / 漫剧 SOP

把 11 篇的流程对齐合并后,得到下面这条八环节流水线。每个环节标注了耗时估算、主流工具、成功判据。

① 选题立项 → ② 剧本 → ③ 角色与场景资产 → ④ 分镜拆解
      → ⑤ 静态关键帧生成 → ⑥ 动态化 → ⑦ 配音配乐与后期 → ⑧ 发布与迭代

总览表

环节 耗时估算 主流工具 成功判据(过了才往下走) 主要出处
① 选题立项 0.5-1 天 番茄小说、抖音/红果榜单 选定一个市场验证过的题材;拆解 3 部对标爆款 H、J、F
② 剧本 0.5-3 天 豆包、DeepSeek、Kimi、Claude、ChatGPT 单集 60-90 秒 / 500-1200 字 / 8-12 镜头;前 10 秒有强钩子;结尾留悬念 H、A、J、K
③ 角色与场景资产 1-3 小时 即梦、Midjourney、LiblibAI、NanoBananaPro、Comicai;进阶用 LoRA / InstantID / IP-Adapter 每个角色有三视图 + 基准图;核心场景有基准场景图 H、I、A、E、C
④ 分镜拆解 1-3 小时 LLM(Claude / 豆包)+ StoriaBoard 每镜 3-5 秒、单一动作、标注景别与运镜;1 分钟视频 5-8 张分镜 H、C、B、D、J
⑤ 静态关键帧生成 1-4 小时 即梦、MJ、SD/ComfyUI、LiblibAI 先静后动;每镜 4-8 张备选择优;画风后缀统一 H、C、B、A
⑥ 动态化 2-6 小时 Seedance 2.0/2.5、可灵 3.0、即梦视频、Vidu、Runway、Pika;零成本方案用剪映关键帧 每段 3-5 秒;每段出 3-5 条挑最好;无畸形闪烁 A、C、G、H、J
⑦ 配音配乐与后期 2-4 小时 剪映、ElevenLabs、豆包语音、Audition、DaVinci 人声有情绪起伏;BGM 不盖人声;字幕对齐;硬切为主 H、B、C、F
⑧ 发布与迭代 0.5 天 + 持续 抖音、快手、红果短剧、视频号、小红书 3 秒完播率 >50%、完播率 >30%、互动率 >3% H、F、G、J

三种产能档位的排期参考

档位 适用 总周期 说明
极速版 一个人、试水 3 天 素材 G 方案:Day1 剧本+分镜,Day2 出素材,Day3 剪辑发布
标准版 一个人、稳定产出 5-7 天 素材 H 的 7 天落地路线;或素材 F 的”3 分钟漫剧 15-20 张图、熟练 1 小时生成”叠加前后期
团队/量产版 3-5 人工作室 60 分钟单集成片 素材 H:AI 流水线压缩至 60 分钟/集;素材 A 的六阶段流水线 + 一体化平台(周期缩短 80% 以上)

极速版详细排期(素材 G 方案)

天 任务 工具
Day 1 剧本(ChatGPT 30 分钟出故事)+ 分镜画面 ChatGPT + 即梦AI
Day 2 生成视频素材:日常动作用即梦;特效镜头用可灵(视频续写最长 2 分钟);数字人对白用通义万相 即梦 + 可灵 + 通义万相 Wan2.5
Day 3 剪辑 + 发布:导入剪映自动加字幕配音、调节奏加 BGM、导出成片 剪映

每个环节的”卡住了怎么办”速查

卡在哪 去看 一句话解法
不知道做什么题材 素材 F、J、H 去番茄小说 / 榜单看什么在火;优先选市场验证过的(末世、甜宠、悬疑、修仙、团宠、种田、古风爽文、穿越逆袭)
剧本写不出来 / 写出来很平 素材 F、H AI 只出初稿,必须自己加反转、改台词、调节奏;逐段修改不要整段重写
角色老变脸 素材 I 第五章 先锁定角色再开拍:三视图 + 基准图 + 每段引用同一参考图
画面好看但拼起来像幻灯片 素材 B 检查景别连续性、动作连贯性、情绪递进;用提示词控制”虚拟摄像机”
抽卡太多、成本爆 素材 A、J 先静后动(素材 H);每段 3-5 条即止;用”三步省 Token 法”
动作抽搐 / 闪烁 素材 C、H Motion Scale 降到 3-4、CFG 提到 7-8;动作描述保持单一;降低动态强度、统一每帧光影参数
成片时长失控 素材 J 工具可能把 3 秒自动补成 10-15 秒,只能后期手剪
完播率低 素材 H 看 3 秒完播率 / 整体完播率 / 互动率三个阈值定位问题

四、提示词模板合集

所有模板均保持原文可复制状态。冲突参数见本章末尾”参数冲突对照”。

4.1 剧本生成

① 竖屏漫剧剧本(素材 H)

你是一位资深AI漫剧编剧,擅长快节奏、强情绪的竖屏漫剧创作。
【题材】:______(如:古风复仇/都市甜宠/悬疑推理)
【核心设定】:______(一句话概括故事核心矛盾)
【主角】:姓名/年龄/身份/性格/核心欲望
【集数与时长】:共__集,每集60-90秒,8-12个镜头
创作要求:
每集前10秒必须有强钩子(冲突/反转/悬念)
每集结尾必须留悬念,引导看下一集
旁白占比40%,对白占比60%,旁白用于心理活动和场景过渡
对白简短有力,单句不超过15字
每集至少1个情绪转折点
输出格式:集数 + 场景 + 人物 + 动作 + 对白 + 旁白

② 网文转短剧(素材 H)

你是专业竖屏漫剧编剧,将下面小说章节改编为60-90秒单集剧本,遵循爆款结构:
0-3秒强冲突钩子,中段快速推进剧情,结尾留反转悬念;
拆分为8-12个镜头,每个镜头标注:序号、景别、运镜、画面描述、人物台词、时长;
区分2D古风漫剧/3D写实仿真人两种画面描述,文字简洁适配AI绘图,删除冗余心理描写。
小说原文:【粘贴你的网文内容】

③ 分镜级脚本(素材 C)

请扮演一位资深短剧编剧。我需要一个30秒的悬疑类短剧,主题是"镜中人的秘密"。请按以下格式输出:
[场景编号] – [时长] – [镜头类型]
画面描述:[用30-50字精确描述人物动作、表情、环境光效]
台词/旁白:[不超过20字]
音效提示:[如:滴水声、心跳声、关门声]
要求:每个场景的画面描述必须包含"可视觉化的动作",例如"手指颤抖着触碰镜面"而非"感到害怕"。

④ 古风种田题材示例(素材 F)

帮我写一个古风种田漫剧的3分钟脚本,主角是穿越成弃妇的现代女医生,她在边疆开荒种地,靠医术逆袭。分3集,每集结尾留悬念。

⑤ 结构化剧本(素材 E):故事类型 + 核心冲突 + 角色设定 + 场景关键词

热血校园剧,转学生发现同学是外星人,男主戴黑框眼镜,女主有猫耳,场景包含教室、天台、秘密基地

4.2 分镜拆解

① 分镜师模板(素材 H)

你是一位资深漫画分镜师,请将以下剧本段落拆解为分镜头脚本。
【剧本段落】:______
【角色基准】:______(粘贴角色设定)
【场景基准】:______(粘贴场景设定)
【画风】:日系动漫 / 国漫厚涂 / 韩系半写实
每个分镜输出:镜号 / 景别(特写/近景/中景/全景/远景)/ 画面描述(人物动作+表情+构图+环境细节)/ 镜头运动(固定/缓慢推近/平移/缩放)/ 时长(秒)/ 对应台词或旁白 / 音效提示
要求:每个镜头3-5秒,单镜头动作单一明确,情绪节点用特写强调。

② 8 要素分镜提示词(素材 A)

CHARACTER(角色) + BACKGROUND(背景) + ACTION(动作) + SCENE(场景) + CAMERA(镜头) + LIGHT(光线) + TEXT(文字) + STYLE(风格)

③ 万能分镜公式(素材 D)

【场景环境】+【角色动作】+【镜头描述】

④ 镜头语言 + 动作描述(素材 E)

中景:男主推眼镜,逆光下镜片反光,女主猫耳突然竖起(镜头右移展示窗外UFO轮廓)

4.3 角色设定

① 角色档案模板(素材 H)

【角色名】:苏晚
【年龄】:22岁
【画风】:日系动漫风格,赛璐璐上色
【外貌】:鹅蛋脸,琥珀色大眼睛,长睫毛,小翘鼻,樱花色嘴唇
【发型】:银灰色长直发,齐刘海,发尾微卷
【服装】:白色古风长裙,腰间系蓝色丝带,袖口绣银色花纹
【体型】:身高165cm,纤细
【性格关键词】:清冷、坚韧、内心柔软
【配饰】:左耳戴一枚蓝色耳坠

② 外貌锚点(素材 I) —— 每个镜头提示词开头粘贴,一字不改

角色C01,25岁亚洲女性,鹅蛋脸,杏仁眼,右眼下方浅色小痣,黑色齐肩直发,三七侧分,银色圆形耳环

③ 定妆照提示词(素材 I)

Portrait photo of a young Chinese woman, 25 years old, oval face, long straight black hair past shoulders, small mole below left eye, white silk blouse, gentle confident expression, studio lighting, clean background, front-facing

④ 角色参考图(素材 B)

a young woman, 25 years old, short black hair, wearing a beige trench coat, photorealistic, cinematic lighting --ar 2:3 --v 6.1

⑤ 2D 角色基准图 / 三视图(素材 H)

古风少女,清冷五官,白色汉服,长发束起,8K超清,国漫二次元,柔和天光,干净背景,全身立绘,三视图(正面、侧面、背面),统一五官特征,无畸变

⑥ 有辨识度的脸(素材 C,解决”网红脸”)

a middle-aged man with a scar on left eyebrow, tired eyes, five o'clock shadow

4.4 生图

① MJ 参数化提示词(素材 C)

A hand with visible veins trembling, reaching toward a fogged mirror, cold white bathroom light, condensation droplets on glass, shallow depth of field, cinematic lighting, horror atmosphere, shot on Arri Alexa 35 --ar 16:9 --style raw --s 250 --v 6

② 通用提示词结尾(素材 H,直接粘贴)

8K 超清,电影级光影,细节拉满,无畸形五官,无扭曲肢体,画面干净,竖屏 9:16,PBR 材质,细腻纹理,景深虚化

③ 通用提示词公式(素材 J)

主体 + 动作 + 场景 + 光影 + 镜头语言 + 风格 + 画质 + 约束

④ 统一画风后缀(素材 H)

日系动漫风格,赛璐璐上色,干净线条,柔和光影,高画质

⑤ 虚拟摄像机(素材 B)

目的 提示词
低角度仰拍 low angle shot, looking up + --ar 9:16
过肩镜头 over the shoulder shot, focus on subject + --iw 2
主观视角 POV shot, first person view, hands visible in frame
航拍俯视 top-down view, bird's eye perspective + --ar 16:9

⑥ 情绪色彩系统(素材 B)

情绪 提示词
紧张 cold blue and gray palette, high contrast, harsh shadows
回忆 sepia tone, warm glow, soft focus, film grain
反转 sudden burst of red, dramatic lighting, rim light

⑦ 电影语言写法对比(素材 B)

❌ 一个人走路
✅ medium shot, tracking shot, man walking down corridor, dust particles in light, cinematic depth of field

⑧ 场景生成(素材 E)

末日废土城市,摩天大楼倾斜,天空呈现紫色电离层

4.5 图生视频

① 小云雀”沉浸式短片黄金公式”(素材 A)

[主体描述] + [画面运动描述] + [音效互动] + [台词] + [音色描述] + [运镜/环境] + [风格修饰] + [限定信息]

② Runway Gen-3 Alpha 运动描述(素材 C)

The character slowly turns head, rain drops on coat, subtle camera push-in

③ Kling 运动描述(素材 C)

walking in rain, wet pavement reflection, cinematic depth of field, slow motion

④ 2D 动态漫动作指令(素材 H)

镜头缓慢向前推进,女主抬头落泪,发丝随风飘动,衣服轻微起伏,自然眨眼,10秒动态,流畅动画,无闪烁崩坏

⑤ 通用运动描述(素材 H)

人物缓慢转头,眼神从冷漠变为惊讶,镜头缓慢推近

4.6 配音与后期

项目 参数 出处
语速 0.9 倍(更自然) 素材 H
语速 1.05 倍;短句停顿 0.2 秒 素材 H(后文”配音参数”段)
BGM 音量 人声的 20%-30% 素材 H
BGM 音量 低于人声 30% 素材 H(后文”配音参数”段)
环境音效音量 -18dB 素材 B
音色分配 女主温柔音 / 男主低沉音 / 旁白中性音 素材 H
音色分配 中文推荐 Rachel / Adam 语音,导出 WAV 素材 B
配乐风格 古风:古筝+笛子;甜宠:钢琴+弦乐;悬疑:低频电子音 素材 H
字幕字体 2D 用书法字体,3D 用简约黑体 素材 H
导出参数 1080P、30 帧、MP4 素材 H

主理人取舍建议:语速上,旁白用 0.9 倍、对白用 1.05 倍是个实用折中——旁白慢一点更沉稳,对白快一点更紧凑;也可以先统一按 1.0 倍生成,再按听感微调。BGM 音量上,两个说法其实指的是同一档位(人声的 20%-30% ≈ 比人声低约 30%),实操建议先设到 20%,导出后戴耳机听一遍,听不清人声就往下调。


五、角色一致性专题

这是所有教程公认的最大痛点。76% 的创作者把”角色变脸”列为第一大痛点(素材 I);素材 H 称其为”漫剧观众流失头号原因”。

5.1 为什么会变脸

AI 视频生成模型是无状态的,每次生成独立运行,不保留角色记忆。三个触发条件:

原因 说明
随机种子不同 同提示词、不同种子 → 不同结果
描述模糊 “年轻女性”有无数种长相
场景变化 光线角度一变,模型重新”理解”角色

5.2 八种方案横向对比

前 7 种来自素材 I(按难度从低到高),第 8 种(ComfyUI 基础版)来自素材 C,作为入门补充。

# 方案 一致性 设定耗时 技术门槛 适用场景 出处
1 图生视频参考图驱动 高(实测 0.67) 约 10 分钟 低 新手起步、正面镜头为主的短剧 I
2 角色卡片 + 外貌锚点 中高 几分钟(写一次) 低 需要多角度、多场景、零成本 I
3 固定种子值 中 几秒 低 同场景批量生成,仅作辅助叠加 I、J
4 AI 换脸后期处理(ReActor / InstantID) 极高 每条后期 中 对话密集型、已拍完需补救 I、B
5 LoRA 角色模型训练(Kohya) 最高(实测 0.91) 5-8 小时/角色 高 长期 IP 运营、固定角色反复使用 I、A、B、H
6 ComfyUI IP-Adapter 多视图工作流 高(实测 0.90) 约 3 天搭工作流 极高 专业工作室、可控性要求极高 I、C
7 全流程管线角色引擎(LumenLine 等) 高(实测 0.88) 约 30 分钟 低 无代码基础、月产 1-2 部 I
8 ComfyUI InstantID + IP-Adapter(基础版) 中高 数小时 中 本地部署用户,作为方案 6 的简化版 C

关键参数速查

方案 参数
1 参考图 三视图(正面+侧面+背面)+ 2-3 个关键表情;侧面/远景匹配度约 55%
3 固定种子 可灵 API 等支持 seed 参数的平台
4 换脸 SD 插件 ReActor v0.6.1(Face swap 模式)或 InstantID
5 LoRA 20-50 张多角度照片;Kohya 训练;rank 32-64;生成时 strength 0.7-1.0;一致性可达 97%(素材 A)/ 0.90+(素材 I)
6 IP-Adapter 工作流 FaceID 0.75 / LoRA 0.8 / ControlNet OpenPose;面部精度优先 0.9 + 0.6;自然变化优先 0.7 + 0.8;特定姿态 0.75 + 0.8 + ControlNet 0.8-1.0
8 InstantID + IP-Adapter InstantID weight=0.8、start_at=0、end_at=0.4;IP-Adapter plus face、scale=0.6(短剧建议 0.5-0.7)

其他教程补充的一致性手段

手段 说明 出处
Master Reference 主参考图 每角色 3-5 张不同角度,存角色库 A
StoryMem 字节与南洋理工联合开发,存储关键帧并在后续场景参考 A
可灵 3.0 多镜头角色相似度 官方称 95%(2026-06 开放 API) A
Seedance 2.0 锁定真人数字人 百集不换脸 H
即梦上传三视图锁定角色 ID 后续分镜自动复用面部特征 H
即梦保存角色参数(肤色、发型代码) 确保跨场景统一;崩图用”局部重绘”修正 E
基于上一张图续生成 先做一张满意的图,再让 AI 基于它生成连续后续画面 D

5.3 四个辅助技巧(低成本,立刻能用)

技巧 做法 出处
① 服装锚点法 固定服装让观众凭服装识别同一角色。为每场景设定固定服装编号(如 C01-A 日常 / C01-B 夜景),分镜表直接填编号 I
② 快速剪辑法 每镜头 2-4 秒快速切换,观众来不及观察面部差异;双人对话用正反打分别生成 I
③ 统一调色法 色调差异会放大不一致感,全片统一后期调色 I
④ 剪辑过渡法 面部差异大的镜头避免连续放置,中间插入环境空镜或他人反应镜头过渡 I
⑤ 统一画风后缀 每条提示词末尾固定加画风描述 H

5.4 按人群选型建议

你的情况 推荐方案 理由
新手第一次做短剧 方案 1(图生视频)+ 技巧①③⑤ 10 分钟设定,一致性够用,零技术门槛
对话密集型短剧 方案 1 + 方案 4(换脸) 正面镜头多,参考图够用;不放心再加一层换脸
月产 1-2 部、无代码基础 方案 7(管线引擎) 30 分钟设定,一致性 0.88,可跨集跨项目复用
月产 3 部+、有技术团队 方案 5 + 方案 6(LoRA + IP-Adapter) 天花板最高,一次投入长期摊薄
固定 IP 长期运营 方案 5(LoRA 训练) 训练一次终身受益,一致性 0.90+
已拍完发现变脸、需补救 方案 4(换脸) 唯一能救已生成素材的方案
本地部署 / ComfyUI 用户 方案 8 → 方案 6 先从 InstantID+IP-Adapter 入手,再升级到三重锁定

一句话结论:先锁定角色再开拍,不要拍完再补。


六、避坑清单

汇总各篇提到的坑,去重合并,按类别分类。

6.1 画面

坑 表现 解法 出处
角色变脸 主角突然换人,观众立刻出戏 先锁定角色再开拍;三视图 + 基准图 + 每段引用同一参考图 H、I、J
不锁定角色就开跑 90% 概率变脸 同上 H
一镜塞太多动作 AI 处理不了复杂长镜头 复杂动作拆成多格(手按剑柄特写→拔剑中景→挥砍近景→对手后退全景) H
动作抽搐 / 闪烁 画面抖动 ① 检查源帧清晰度 ② Motion Scale 降到 3-4 ③ CFG Scale 提到 7-8 ④ 动作描述保持”单一动作” ⑤ 降低动态强度、统一每帧光影参数 C、H、A
肢体扭曲 / 畸形穿模 四肢异常 提示词加”正常人体结构,四肢完整,无畸形” H
画面闪烁抖动(时序) 帧间不连贯 时序平滑处理 A
画质不稳定 时好时坏 优化提示词 + 增加约束 A
风格不统一 各镜头画风割裂 ① 建立统一风格参考图库 ② 统一画风后缀 ③ 同一条视频尽量用同一个工具完成 ④ IP-Adapter style reference scale 统一 0.6,negative prompt 保持一致 A、H、D、C
MJ 网红脸无辨识度 人物千篇一律 加具体特征(疤痕、疲惫眼神、胡茬);--s 降到 200 以下;或用 InstantID 固定人脸 C
提示词只写人物不写光影运镜 画面质感廉价 补全光影、运镜、画质词 H
3D 仿真人不调灯光 画面扁平 用自带灯光机位的工具(即梦3D片场、可灵3D数字人) H
一次性生成全部分镜不单独校验 后期返工量大 先静后动,逐镜确认 H
画面比例选错 横屏素材直接发短视频,流量减半 竖屏 9:16 H、J
直接文生视频 可控性太低 新手先静后动,用图生视频 H
Runway 超过 5 秒 画面扭曲 每段 2-3 秒后期拼接 C
源帧不清晰 后续全崩 静态关键帧阶段就择优 C

6.2 声音

坑 表现 解法 出处
配音敷衍 全程 AI 平铺朗读,完播率腰斩 声音情绪价值被低估,宁可画面简一点,配音不能平;关键台词加重语气 H
BGM 音量盖过人声 观众直接划走 控制在人声的 20%-30% H
只用 BGM 不加音效 缺乏沉浸感 叠加两层音轨( Epidemic Sound / Artlist / Freesound.org / 豆包音效),环境音效 -18dB C、B、H
忽略音效 拔剑声、脚步声、风声、心跳声缺失 按分镜逐条补 H
旁白与字幕不对齐 观感割裂 严格对齐,手动润色字幕 H

6.3 节奏

坑 表现 解法 出处
单集超 2 分钟 完播率大幅下跌 单集控制在 60-90 秒 H
大量静态 PPT 式图片无动态运镜 平台限流 加 Ken Burns / 关键帧动画 / 图生视频 H、B
镜头时长失控 剧本写 3 秒,工具自动补成 10-15 秒,成片翻倍 只能后期手剪 J
忽略结尾悬念 追更率暴跌 每集结尾必留反转/悬念 H、F
开头钩子不够硬 3 秒完播率 < 50% 前 10 秒必须有强钩子;前三秒放大冲突画面 + 醒目大字标题 H
转场硬切过度 观感跳 素材 C 建议溶解转场 0.3-0.5 秒;素材 H 建议全程硬切不要淡入淡出 —— 两者冲突,见下 C、H

冲突提示:素材 C 建议”转场避免硬切,用溶解转场 0.3-0.5 秒”;素材 H 建议”全程硬切不要淡入淡出”。
取舍建议:短剧/漫剧节奏快,主导意见是硬切(素材 H、J 均明确”硬切为主”)。溶解转场更适合素材 B 那种偏氛围、偏”漫剧电影感”的慢节奏作品。按你的赛道选:快节奏爽文用硬切,悬疑氛围向可少量用 0.3 秒溶解。

6.4 合规

坑 表现 解法 出处
无授权网文商用发布 侵权风险 优先走官方授权渠道(抖音创作者中心→短剧版权中心;番茄百万网文 IP 免费申请改编) H
BGM、字体、素材不可商用 侵权风险 全部使用可商用素材 H
AI 生成内容版权灰色地带 权属不清 角色原创、背景不用真实地标、标注 Generated by AI B

6.5 成本与流程

坑 表现 解法 出处
成本过高 抽卡无止境 ① 先小规模测试再批量 ② 先静后动减少无效抽卡 ③ 每段出 3-5 条即止 ④ 三分多钟样片可能需抽上百条,成本一般几百元、极致效果上千元 A、H、J
追求完美才发布 永远出不了片 先完成再完美 H
一上来追求完美技术栈 学习曲线陡峭 先用 huobao-drama 这类全自动工具跑通一遍,再逐环节优化 J
整段重写剧本 越改越乱 逐段修改 H
分镜拆得太粗 后期返工量大 分镜拆得越细,后面返工越少,这一步的时间后面能省回三倍 H
混用多个工具 风格割裂 同一条视频尽量用同一个工具完成 D
硬件不够 跑不动本地模型 最低 8GB 显存(RTX3070/3060/4050)+ 16GB 内存;不够用 Google Colab / RunPod(约 0.2 美元/小时)/ AutoDL / Colab Pro V100(约 10 美元/月) B、A、C
8G 显存跑 ComfyUI OOM --lowvram 启动;选 SD 1.5 而非 SDXL;batch_size=1;尺寸 512×512(后期 Topaz 超分) C
万播收益在跌 同样播放量收益从几百块降到几十块 关键在内容质量;头部创作者月入十万的例子仍在 F
窗口期有保质期 平台补贴退潮、监管收紧后单打独斗空间收窄 尽早跑通闭环 J

6.6 终极避坑 10 条(素材 H 原文汇总)

  1. 无版权网文不要商用发布
  2. 角色不锁定直接生成,90% 概率变脸
  3. 单集超 2 分钟,完播率大幅下跌
  4. 提示词只写人物不写光影运镜,画面质感廉价
  5. BGM 音量盖过人声,观众直接划走
  6. 3D 仿真人不调灯光,画面扁平
  7. 一次性生成全部分镜不单独校验,后期返工量大
  8. 忽略结尾悬念,追更率暴跌
  9. 大量静态 PPT 式图片无动态运镜,平台限流
  10. 画面比例选错,横屏素材直接发短视频流量减半

七、新手学习路径建议

7.1 素材 H 的 7 天落地路线(推荐主线)

Day 任务 产出
Day1 赛道定位 + 领番茄免费网文IP + 拆解 3 部对标爆款 选定题材,攒 3 部对标分析
Day2 练 AI 写分镜脚本 1 集完整分镜表
Day3 2D 角色生成 + 锁定不换脸 主角三视图 + 基准图
Day4 3D 仿真人捏人 + 3D 片场机位灯光 3D 角色(可选,做 2D 可跳过)
Day5 图生视频批量生成,解决闪烁畸形 全部镜头片段
Day6 配音音效剪辑全流程 第一版粗片
Day7 调色封面优化 + 发布复盘 + 固化个人 SOP 成片 + 你的个人 SOP

7.2 素材 B 的 8 周导演能力路线(叙事/镜头语言专项)

阶段 任务
第 1-2 周 掌握 SD 的 ControlNet 和 ReActor,每天生成 20 组分镜练习
第 3-4 周 用 DaVinci 完成 3 部 1 分钟短剧,练 Ken Burns 和转场节奏
第 5-8 周 模仿经典电影开场(如《盗梦空间》旋转走廊)复现镜头语言

7.3 素材 A 的三档技术栈升级路径

档位 工具组合 适合
入门级 一站式平台(火山剧创 / 小云雀 / 万兴剧厂 / AniShort / 咪咕悦创) 零基础,先跑通
进阶级 Seedance + 剪映 + AI 配音 已跑通,追求质量与可控性
专业级 ComfyUI 节点工作流 + 训练专属 LoRA 工作室、长期 IP

7.4 整合后的四阶段练习路线(建议按这个走)

阶段 目标 具体动作 判据
阶段一:跑通(1-2 周) 完整做出第一条,不求质量 ① 用素材 D 的”5-8 张分镜 / 1 分钟”基准做一条 1 分钟漫剧 ② 工具只用即梦 + 剪映 ③ 配音用剪映自带 能导出一条完整 MP4
阶段二:稳定(3-4 周) 解决变脸和节奏 ① 按素材 I 方案 1 建立角色三视图工作流 ② 按素材 H 做 60-90 秒单集、8-12 镜头 ③ 加 Ken Burns / 关键帧动画 3 秒完播率 > 50%
阶段三:提质(1-2 月) 画面与声音升级 ① 学素材 B 的景别连续性、虚拟摄像机、情绪色彩 ② 配音按角色分配音色、调语速、控制 BGM 音量 ③ 尝试图生视频(可灵 / Seedance / Vidu) 完播率 > 30%、互动率 > 3%
阶段四:量产 / 专业化(2 月+) 提效、降本、建 SOP ① 切换到一体化平台(火山剧创 / 小云雀等)或自建 ComfyUI 工作流 ② 固定 IP 考虑训练 LoRA ③ 固化个人 SOP,按数据迭代 单集周期压到 1 天内

建议:阶段一务必”先完成再完美”(素材 H),并且先用 huobao-drama 这类全自动工具跑通一遍再逐环节优化(素材 J)。


八、行业数据速览

所有数据均标注出处素材。不同来源口径不同,未强行统一。

8.1 市场规模

数据 数值 出处
2024 年市场规模 不足 50 亿元 H
2025 年市场规模 168 亿元(同比 +276%);2025 被称为”AI漫剧爆发元年” H
2026 年 1-5 月市场规模 突破 220 亿元 A
2026 年全年预测 有望冲击 400 亿元 A
2026 年全年预测(艾媒咨询) 243.6 亿元 H
2026 年全年预测(36氪) 有望冲击 300 亿 H

8.2 产量与用户

数据 数值 出处
2025 年抖音端原生漫剧上线数 突破 6 万部,全年累计播放超 757 亿次 H
2026 年 1 月单月上线 AI 漫剧 超 1.4 万部 H
2026 Q1 上线微短剧 12.8 万部,其中 AI 微短剧 12.2 万部,占比超 95% A
2026 上半年 AI 短剧用户 突破 6 亿 A
2026 年仿真人剧占比 已增至 38% A

8.3 播放与爆款

作品 数据 出处
《万妖图录传第八季》 热度 8919 万居首 A
《风水之王》 播放超 3.7 亿、红果 110 万收藏 A
《李世民魂穿阿斗》 上线不到一个月全网播放破亿 A
《被裁掉的女孩》 累计播放破 2 亿 A
2026 年 7 月第二周 AI 短剧首次实现”流量超车“——红果热播总榜前五占四席 A

8.4 成本与周期

项目 数据 出处
单部全流程 AI 参与出片 48 小时可出片 H
算力成本 低至 3000 元 H
AI 流水线单集 60 分钟成片(传统动画团队一集需 3-7 天) H
整体成本对比 真人剧的 1/5 到 1/4 G
制作周期 从天级压到 3 天,一个人跑完全流程 G
工具链成本 约 2000~5000 元/月 K
《万兽独尊》 60 集约 4 万多字,5 人团队 8 天完成(传统需 3-6 个月) A
《霍去病》 3 人团队、3000 元算力、4 天,播放破百万 A
《重回高考》 四川苍溪县零基础团队 40 天完成,登新剧榜第 16 名 A
抽卡成本 一般几百元,极致效果上千元;三分多钟样片可能需抽上百条 A
主流模型单次时长 最多 15 秒 A
一体化平台提效 周期缩短 80% 以上(火山剧创 1.0) A
3 分钟漫剧图量 约 15-20 张图,熟练 1 小时生成完 F

8.5 变现

项目 数据 出处
抖音 开通创作收益权限后播放量直接换钱;S+ 级漫剧有保底 75 万播放量扶持 F
红果短剧 分成比例高,新人有激励奖金;字节专门的漫剧平台,有付费分成机制 F、H
品牌定制短剧 一条收 3000-10000 元 G
万播收益趋势 在跌——早期百万播放收益几百块,现在同样播放量可能只有几十块 F
头部创作者 月入十万的例子仍在,关键在内容质量 F
ElevenLabs 约 5 美元/月(可用微软 Azure 免费 TTS 替代) B
算力租赁 RunPod 约 0.2 美元/小时;Colab Pro V100 约 10 美元/月 B、C

8.6 供给侧结构变化

重庆某从业者称其认识的近 10 家短剧公司里还在做真人实拍的只剩两三家,有一家直接砍了导演岗位全转 AI。(素材 J)

窗口期有保质期——平台还在砸钱扶持、工具还在迭代、审核细则未完全落地;等头部内容工厂产能拉满、平台补贴退潮、监管收紧,单打独斗的空间会快速收窄。(素材 J)


附录:参数与说法冲突对照表

# 冲突项 说法 A 说法 B 主理人取舍建议
1 语速 0.9 倍更自然(H) 1.05 倍,短句停顿 0.2 秒(H 后文) 旁白 0.9 倍、对白 1.05 倍;或先按 1.0 生成再按听感调
2 BGM 音量 人声的 20%-30%(H) 低于人声 30%(H 后文) 实为同一档位。先设 20%,戴耳机复听后微调
3 转场 硬切,不要淡入淡出(H、J) 溶解转场 0.3-0.5 秒,避免硬切(C) 快节奏爽文用硬切;悬疑氛围向可少量用 0.3 秒溶解
4 Sora 已于 2026-03 被 OpenAI 关停(A) 被列为推荐工具(D、K) 以素材 A 为准,D、K 工具清单已过时
5 LoRA 训练图量 30-50 张(A) 20-50 张(I) 取 30-50 张更稳妥,图越多越稳
6 LoRA 一致性 97%(A) 0.90+(I 实测) 97% 为理想值,0.90+ 为实测值,按 0.90 做预期管理
7 每镜时长 3-5 秒(H、C 部分场景) 3-8 秒(C,30 秒短剧 6-8 场景) 新手按 3-5 秒,节奏熟练后可在情绪镜头放宽到 6-8 秒
8 批量数 每镜 4-8 张备选(H) batch_size=4 / 4-6 张(C、B) 4-6 张起步;关键镜头放宽到 8 张
9 CFG Scale 7(B,SD 直出) 7.5(C,ComfyUI)/ 提到 7-8 治抽搐(C) 默认 7-7.5;动作抽搐时提到 7-8

附:素材来源完整清单

编号 标题 链接
A AI短剧教程:从零开始掌握人工智能短剧创作全流程 https://www.tahou.com/article/214836021472535557
B AI 漫剧导演:用人工智能讲好每一个故事 https://m.toutiao.com/article/7660392807806304787
C AI短剧制作:从脚本生成到画面渲染的全链路 https://www.2ds.cn/?p=21002/
D 2025年风口项目:AI漫剧怎么做?这套”傻瓜式”教程请收好 https://m.toutiao.com/article/7595061848358027830
E AI影视漫画怎么做的视频?AI工具帮你搞定剧本、角色、分镜、动态、后期全流程 https://www.chooseai.net/news/1067/
F AI漫剧订单暴涨14倍,我拆解了普通人赚钱全流程 https://www.toutiao.com/article/7682037576450032168
G AI短剧制作全流程——成本几百块,3天出一部 https://www.toutiao.com/article/7668673383726449167
H AI漫剧制作全流程(长文,2026年) 来源链接缺失(检索自公开内容平台)
I 7种角色一致性方案 来源链接缺失(检索自公开内容平台,火星人教育公众号内容)
J AI短剧·漫剧实战从0到1(系列) 腾讯 ima 知识库收录,https://ima.qq.com/wiki/ (无精确文章链接)
K 流程|4步做出一部AI短剧(拆解彭青云案例) 腾讯 ima 知识库收录,https://ima.qq.com/wiki/ (无精确文章链接)

声明:素材 H、I 无可用原文 URL,已如实标注;素材 J、K 为腾讯 ima 知识库收录,具体文章页 URL 不稳定,未编造精确链接。全文未编造任何 URL。

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。