
导读
此合集整理了 11 篇 AI 短剧 / AI 漫剧教程,覆盖三个层次:零基础能照抄的保姆级流程(素材 D、F、G、H)、带具体参数的进阶级实操(素材 B、C、E、J、K)、行业方法论与变现视角(素材 A、F、I)。
三件事你应该先知道:
- 角色一致性是生死线。76% 的创作者把”角色变脸”列为第一大痛点(素材 I),素材 H 称其为”漫剧观众流失头号原因”。先锁定角色,再开拍,不要拍完再补。
- 流程已经工业化。一体化平台(火山剧创、小云雀、万兴剧厂)能把周期压缩 80% 以上,一部 AI 漫剧全流程 48 小时可出片、算力成本低至 3000 元(素材 A、H)。个人单干仍然可行,成本约几百到数千元。
- 内容比工具重要。多篇文章反复强调:AI 写的剧本千篇一律,必须自己改(素材 F);分镜设计与叙事节奏是 AI 替代不了的核心能力(素材 K)。
怎么用这份文档:
– 完全没做过 → 直接跳到 第七章学习路径,按 Day1-Day7 走,配合 第四章模板 复制提示词。
– 已经会做但角色老变脸 → 直接看 第五章角色一致性专题。
– 已有产能想提速 / 降本 → 看 第三章通用 SOP 和 第八章行业数据。
– 想了解能不能赚钱 → 看素材 F 与第八章。
一、教程清单速览表
| 编号 | 标题 | 来源平台 / 发布信息 | 定位 | 难度 | 适合人群 | 链接 |
|---|---|---|---|---|---|---|
| A | AI短剧教程:从零开始掌握人工智能短剧创作全流程 | 塔猴 · AI观察者|2026-08-18 | 行业级全流程 + 行业数据 | ★★★☆☆ | 想全面了解赛道、工具选型、平台动态的从业者 | https://www.tahou.com/article/214836021472535557 |
| B | AI 漫剧导演:用人工智能讲好每一个故事 | 今日头条 · 火星人教育|约1周前 | 叙事/导演思维(解决”像幻灯片”) | ★★★☆☆ | 会生图但组合起来没叙事感的人 | https://m.toutiao.com/article/7660392807806304787 |
| C | AI短剧制作:从脚本生成到画面渲染的全链路 | 火星人教育官网|2026-06-14 | 技术参数最硬核(ComfyUI 节点级) | ★★★★★ | 愿意折腾本地部署、追求可控性的技术型创作者 | https://www.2ds.cn/?p=21002/ |
| D | 2025年风口项目:AI漫剧怎么做?这套”傻瓜式”教程请收好 | 今日头条 | 零基础最友好入门版 | ★☆☆☆☆ | 完全零基础、第一次接触 | https://m.toutiao.com/article/7595061848358027830 |
| E | AI影视漫画怎么做的视频?AI工具帮你搞定剧本、角色、分镜、动态、后期全流程 | ChooseAI | 搭积木式五块流程 + 工具清单 | ★★☆☆☆ | 想快速了解”有哪些工具可用” | https://www.chooseai.net/news/1067/ |
| F | AI漫剧订单暴涨14倍,我拆解了普通人赚钱全流程 | 今日头条 | 变现视角 + 四步流程 + 避坑 | ★☆☆☆☆ | 关心收益、想跑通变现闭环 | https://www.toutiao.com/article/7682037576450032168 |
| G | AI短剧制作全流程——成本几百块,3天出一部 | 今日头条 · 帝听听问|2026-07-31 | 成本/周期视角的极简工作流 | ★★☆☆☆ | 一个人、小成本、想快速出片 | https://www.toutiao.com/article/7668673383726449167 |
| H | AI漫剧制作全流程(长文,2026年) | 检索自公开内容平台(来源链接缺失) | 最详细的零基础保姆级(2D+3D 双赛道) | ★★☆☆☆ | 想完整照抄一套流程的零基础创作者 | 来源链接缺失(检索自公开内容平台) |
| I | 7种角色一致性方案 | 检索自公开内容平台(火星人教育公众号内容,来源链接缺失) | 角色一致性专题(方案最全 + 实测数据) | ★★★★☆ | 被”变脸”卡住的所有人 | 来源链接缺失(检索自公开内容平台) |
| J | AI短剧·漫剧实战从0到1(系列) | 腾讯 ima 知识库收录(具体文章页 URL 不稳定) | 实战派七步工作流 + 避坑 | ★★☆☆☆ | 想按”七步”标准化作业的实操派 | https://ima.qq.com/wiki/ (知识库分享页,无精确文章链接) |
| K | 流程|4步做出一部AI短剧(拆解彭青云案例) | 腾讯 ima 知识库收录(同上) | 极简四步闭环 + 从业者视角 | ★☆☆☆☆ | 想先看全貌、评估投入产出 | https://ima.qq.com/wiki/ (知识库分享页,无精确文章链接) |
时效性警告(重要):
– 素材 A 明确记录 Sora 已于 2026 年 3 月被 OpenAI 关停网页端 / App / 开发者服务,当前赛道由国产模型主导。素材 D、K 中仍把 Sora 列为推荐工具,这两篇的工具清单已过时,请以素材 A 为准。
– 素材 B 自述工具链为”2025 年 3 月版”(MJ V6.1、SD WebUI 1.9.4、DaVinci 18.6、Kling 1.5 等),素材 C 使用 Claude 3.5 Sonnet / MJ V6 / Runway Gen-3 Alpha / Kling 1.5。两篇的方法论与参数依然有效,但版本号应替换为当前最新(如 Seedance 2.0/2.5、可灵 3.0)。
– 素材 D 标题写”2025年风口项目”,发布较早,工具建议偏旧,流程思路仍可借鉴。
二、逐篇详解
素材 A|《AI短剧教程:从零开始掌握人工智能短剧创作全流程》
🔗 https://www.tahou.com/article/214836021472535557 |塔猴 · AI观察者|2026-08-18
核心流程(六阶段流水线)
剧本立项 → AI解析 → 人设生成 → 抽卡生视频 → 后期精修 → 成片输出
| 阶段 | 关键动作 | 要点 |
|---|---|---|
| 1 剧本立项 | 原创 / 改编优质故事 / 平台对接获取 | 三种剧本来源途径 |
| 2 AI解析 | 内容审核 → 导演监制提取人设、人物关系、场景、冲突点 → 投喂 LLM 生成世界观、人物设定、核心情节、场景道具 | 先人工审核再投喂 LLM |
| 3 人设生成 | 生成角色/场景资产 | 见第五章一致性方案 |
| 4 抽卡生视频 | 批量生成、择优 | 单次最多 15 秒;三分多钟样片可能抽上百条 |
| 5 后期精修 | 剪辑、配音、调色 | — |
| 6 成片输出 | 导出分发 | — |
推荐工具链
| 类型 | 工具 | 说明 |
|---|---|---|
| 一站式平台 | 火山剧创 1.0(字节火山引擎,2026-05-21 上线) | 剧本解析→全剧资产设定→分镜视频生成→成片预览;多智能体架构 + Seedance + Seedream;周期缩短 80% 以上 |
| 一站式平台 | 小云雀 AI 短剧 Agent(2026-03-19) | 全球首个搭载 Seedance 2.0 的行业智能体;最多上传 10 万字剧本一键出片 |
| 一站式平台 | AniShort(2026-03) | 无限画布、节点化协同创作 |
| 一站式平台 | 万兴剧厂 | 集成 Seedance 2.0、Vidu Q3、Kling 3.0 4K |
| 一站式平台 | 咪咕悦创(2026-07) | — |
| 视频模型 | Seedance 2.0 / 2.5(字节自研,2026-06 发 2.5) | 当前主流 |
| 视频模型 | 快手可灵 3.0(2026-06 开放 API) | 多镜头角色相似度 95% |
| 视频模型 | HappyHorse 1.1(阿里云,2026-06-22) | — |
| 视频模型 | ~~Sora~~ | 已关停(2026-03,OpenAI 关停网页端/App/开发者服务) |
| 剪辑 | 剪映专业版(2026-06 AI 文字成片升级) | 一句话生成脚本 + 匹配画风 + 分镜 + 智能配音 |
| 本地工作流 | ComfyUI(配 Flux、IP-Adapter、FaceID) | 节点式 |
可直接复制的提示词模板
分镜提示词 8 要素(CBASCLTS):
CHARACTER(角色) + BACKGROUND(背景) + ACTION(动作) + SCENE(场景) + CAMERA(镜头) + LIGHT(光线) + TEXT(文字) + STYLE(风格)
小云雀官方”沉浸式短片黄金公式”:
[主体描述] + [画面运动描述] + [音效互动] + [台词] + [音色描述] + [运镜/环境] + [风格修饰] + [限定信息]
提示词技巧(原文):图像提示词用英文逗号分隔短语,少用中文长句;视频提示词按”镜头1/镜头2/镜头3″顺序组织;必须加
NOT humans等约束子句避免无关内容。
这篇文章最有价值的一点:它是唯一一篇把一站式平台矩阵(火山剧创 / 小云雀 / AniShort / 万兴剧厂 / 咪咕悦创)和行业供给侧数据(市场规模、上线部数、成本周期、算力成本)完整列出来的,适合用来做工具选型和赛道判断。
适合什么人在什么阶段看:入行前做赛道调研时;以及已在手工流程上跑通、准备切换到一体化平台提效时。
素材 B|《AI 漫剧导演:用人工智能讲好每一个故事》
🔗 https://m.toutiao.com/article/7660392807806304787 |今日头条 · 火星人教育|约1周前
核心观点:AI 漫剧不是连环画
| 连环画 | AI 漫剧 | |
|---|---|---|
| 画面 | 静态图排列 | 动态 |
| 叙事 | 每图独立叙事 | 镜头切换、景别变化、节奏控制 |
| 核心能力 | 画师用笔讲故事 | 导演用提示词和工具调度故事 |
三个核心概念:
1. 景别连续性 —— 避免相邻镜头同景别,否则产生”跳帧感”
2. 动作连贯性 —— 相邻帧动作有逻辑承接(抬手→握拳→挥出)
3. 情绪递进 —— 用光影、色彩、构图引导情绪
痛点数据:火星人教育统计,过去三个月超 70% 学员卡在”从图像到叙事”的跃迁。
推荐工具链(原文标注为 2025 年 3 月版)
| 环节 | 工具 | 参数/说明 |
|---|---|---|
| 图像生成 | Midjourney V6.1 | --style raw --v 6.1 --s 250 |
| 图像生成 | Stable Diffusion WebUI 1.9.4 + ControlNet 1.1.4 | — |
| 角色一致性 | SD 插件 ReActor v0.6.1 / MJ --cref |
— |
| 分镜剪辑 | DaVinci Resolve 18.6(免费版即可)/ CapCut 3.8.0 | — |
| 语音 | ElevenLabs(TTS 模型 v2)+ Adobe Audition 2024 | 中文推荐 Rachel / Adam 语音,导出 WAV |
可直接复制的提示词模板
① 角色参考图:
a young woman, 25 years old, short black hair, wearing a beige trench coat, photorealistic, cinematic lighting --ar 2:3 --v 6.1
② 用提示词控制”虚拟摄像机”:
| 目的 | 提示词 |
|---|---|
| 低角度仰拍 | low angle shot, looking up + --ar 9:16 |
| 过肩镜头 | over the shoulder shot, focus on subject + --iw 2 |
| 主观视角 | POV shot, first person view, hands visible in frame |
| 航拍俯视 | top-down view, bird's eye perspective + --ar 16:9 |
③ 情绪色彩系统:
| 情绪 | 提示词 |
|---|---|
| 紧张 | cold blue and gray palette, high contrast, harsh shadows |
| 回忆 | sepia tone, warm glow, soft focus, film grain |
| 反转 | sudden burst of red, dramatic lighting, rim light |
④ 让 AI 理解镜头语言(对比示例):
❌ 一个人走路
✅ medium shot, tracking shot, man walking down corridor, dust particles in light, cinematic depth of field
SD + ReActor 角色一致性实操参数(耗时约 1 小时)
| 项目 | 参数 |
|---|---|
| 大模型 | Realistic Vision V5.1 或 DreamShaper 8 |
| ControlNet | Canny 模式,权重 0.8 |
| ReActor | 上传参考图,勾选 Enable,Face swap 模式 |
| 批量 | Batch 一次 4-6 张选最佳 |
| 采样 | Steps: 30, CFG Scale: 7, Sampler: DPM++ 2M Karras |
| 提示词一致性 | 每镜保持角色描述一致:same woman, short black hair, beige trench coat |
动态化参数(DaVinci Resolve 18.6 + 免费插件 Keyframe Assistant,约 2 小时)
| 项目 | 参数 |
|---|---|
| Ken Burns 效果 | Inspector→Transform,缩放 100%→105%(缓慢推进),位置偏移不超过画面 10% |
| 转场 | Cross Dissolve 0.3-0.5 秒;相邻镜头景别不同时用 Dip to Black |
| 环境音效 | Freesound.org 下载,Audition 做 5 秒循环,音量 -18dB |
叙事节拍(节奏控制)
| 场景类型 | 每帧停留 | 转场 |
|---|---|---|
| 对话 | 3-5 秒 + 缓慢推拉 | — |
| 动作 | 1-2 秒 + 快速缩放/滑动转场 | — |
| 悬念 | 关键帧 6-8 秒 + 环境音效渐强 | DaVinci Speed 工具(如 50% 慢放) |
案例结构参考(3 分钟悬疑漫剧《深夜图书馆的脚步声》)
三幕式:铺垫 30 秒 → 冲突 2 分钟 → 反转 30 秒;拆 12-15 个分镜,每镜标注景别、角色表情、环境氛围。
| 镜号 | 景别 | 画面 | 声音 |
|---|---|---|---|
| 1 | 全景 | 深夜图书馆走廊,昏黄灯光 | 脚步声渐强 |
| 2 | 中景 | 主角背影,手电筒光晃动 | 呼吸声 |
| 3 | 特写 | 主角惊恐表情,汗珠滑落 | “谁在那里?” |
这篇文章最有价值的一点:“用提示词控制虚拟摄像机”和”情绪色彩系统”这两张表。绝大多数教程只教怎么生成好看的图,这篇教你用电影语言调度画面——这是”100 张图组合起来像幻灯片”和”一条能看的漫剧”之间的真正差距。
适合什么人在什么阶段看:已经能稳定出图、但成片”没感觉”的人。建议在跑通第一版流程后立刻回来看这篇。
素材 C|《AI短剧制作:从脚本生成到画面渲染的全链路》
🔗 https://www.2ds.cn/?p=21002/ |火星人教育官网|2026-06-14
核心链路五环节
结构化脚本 → 参数化提示词 → 角色一致性控制 → 动态帧生成 → 后期合成
原文强调:角色一致性是瓶颈,也是专业与业余的分水岭。
常见错误:让 AI 直接写完整剧本再”翻译”成画面 → 画面台词脱节,因为语言模型不理解”视觉节奏”。正解是分步生成。
第一步:分镜级脚本(Claude 3.5 Sonnet,推荐 2024 年 8 月后版本)
请扮演一位资深短剧编剧。我需要一个30秒的悬疑类短剧,主题是"镜中人的秘密"。请按以下格式输出:
[场景编号] – [时长] – [镜头类型]
画面描述:[用30-50字精确描述人物动作、表情、环境光效]
台词/旁白:[不超过20字]
音效提示:[如:滴水声、心跳声、关门声]
要求:每个场景的画面描述必须包含"可视觉化的动作",例如"手指颤抖着触碰镜面"而非"感到害怕"。
输出示例:
[SCENE 1] - 5s - 特写
画面描述:深夜浴室的冷白色灯光下,一只颤抖的手缓慢伸向布满水雾的镜子。指尖在镜面上划出一道弧线,水珠顺着手指滑落。
台词:旁白:"你相信镜子里的自己,会先开口说话吗?"
音效提示:水滴声,低频嗡鸣
关键参数:每场景 3-8 秒;30 秒短剧建议 6-8 个场景;镜头类型只用”特写/中景/全景”,避免复杂运镜。
第二步:参数化提示词(MJ V6)
A hand with visible veins trembling, reaching toward a fogged mirror, cold white bathroom light, condensation droplets on glass, shallow depth of field, cinematic lighting, horror atmosphere, shot on Arri Alexa 35 --ar 16:9 --style raw --s 250 --v 6
| 参数 | 说明 |
|---|---|
--ar 16:9 |
短剧标准画幅 |
--style raw |
减少过度美化 |
--s 250 |
风格化(悬疑类建议 200-300) |
--v 6 |
版本 |
第三步:ComfyUI(v0.2.7)+ InstantID + IP-Adapter
| 节点 | 作用 | 参数 |
|---|---|---|
| InstantID | 固定角色面部特征 | 上传主角正脸照(纯色背景、正面光照均匀);weight=0.8,start_at=0,end_at=0.4。weight 太高会面部僵硬,0.8 是平衡点 |
| IP-Adapter | 保持画面风格一致(色调/光影/质感) | 上传第一帧生成图作风格参考;用 plus face 模型;scale=0.6。短剧建议 0.5-0.7 |
工作流搭建:
1. 基础模型 Realistic Vision V5.1(写实类首选)
2. KSampler:步数 30、CFG Scale 7.5、采样器 DPM++ 2M Karras
3. InstantID 和 IP-Adapter 接到 KSampler 正面提示词输入
4. batch_size=4 每次生成 4 帧择优
实操案例(”穿黑色风衣的侦探”3 场景:雨中低头行走全景 / 抬头看向路灯中景 / 眼神特写):
❌ 错误:每场景单独写提示词,不引参考图
✅ 正确:
① 先出正脸图作 InstantID 输入
② 每场景提示词结尾加 –iw 0.8 –no deformed face, weird eyes
③ 场景2、3 除引用正脸图外,还引用场景1输出图作 IP-Adapter 风格参考
第四步:动态化两条路径
| 路径 A:Runway Gen-3 Alpha | 路径 B:Kling 1.5 | |
|---|---|---|
| 适用 | 5 秒内短片段 | 长镜头,最长 10 秒 |
| 操作 | 上传静态首帧 → 运动描述 → Motion Scale=5(短剧建议 3-6)、End Frame=0 |
上传关键帧 → Duration=5、Mode=Standard |
| 提示词 | "The character slowly turns head, rain drops on coat, subtle camera push-in" |
"walking in rain, wet pavement reflection, cinematic depth of field, slow motion" |
| 后期 | Topaz Video AI 做 4K 超分和补帧(60fps,模型 Artemis) | 剪映专业版做音画同步剪辑 |
| 注意 | 不要超过 5 秒否则扭曲,建议每段 2-3 秒后期拼接 | 物理规律模拟更好,走路、风吹衣摆更自然 |
后期合成:音效不要只用 BGM(用 Epidemic Sound / Artlist 搜具体音效,叠加两层音轨);转场避免硬切,用 Filmora 或 DaVinci 的溶解转场 0.3-0.5 秒;字幕手动润色后用 ArcTime 或剪映智能字幕。
FAQ 要点(原文)
| 问题 | 解法 |
|---|---|
| MJ”网红脸”无辨识度 | 加具体特征:a middle-aged man with a scar on left eyebrow, tired eyes, five o'clock shadow;把 --s 降到 200 以下;或用 InstantID 固定有辨识度的人脸 |
| 动作”抽搐” | 检查源帧清晰度;Runway/Kling 把 Motion Scale 降到 3-4;CFG Scale 提到 7-8;动作描述保持”单一动作” |
| 多场景风格统一 | IP-Adapter 的 style reference 模式,scale 统一 0.6;所有场景 negative prompt 保持一致;推荐加 "cartoon, anime, 3D render, low quality, blurry" |
| 8G 显存跑 ComfyUI | 用 --lowvram 启动;选 SD 1.5 而非 SDXL;batch_size=1;尺寸 512×512(后期 Topaz 超分);或 Google Colab Pro 的 V100(约 10 美元/月) |
进阶方向:AnimateDiff(更流畅动画,非写实风格);ElevenLabs 语音克隆(给主角定制专属声音);GPT-4o 视觉分析(自动检测画面是否符合脚本)。
这篇文章最有价值的一点:InstantID weight=0.8 / start_at=0 / end_at=0.4 + IP-Adapter plus face scale=0.6 这组可复现的节点级参数,以及”动作抽搐 → 降 Motion Scale 到 3-4、提 CFG 到 7-8″的调参路径。这是唯一一篇给出完整 ComfyUI 数值的文章。
适合什么人在什么阶段看:本地部署 / ComfyUI 用户;以及对画面可控性要求高、愿意为质量花时间调参的人。
素材 D|《2025年风口项目:AI漫剧怎么做?这套”傻瓜式”教程请收好》
🔗 https://m.toutiao.com/article/7595061848358027830 |今日头条
三大块:分镜 / 动画 / 发布
① 分镜制作 —— 视频的”设计图”,像画连环画。
| 项目 | 内容 |
|---|---|
| 常用工具 | 即梦、Nano banana pro、seko |
| 操作步骤 | ① 喂素材:上传剧本、角色图、场景图 ② 排顺序:1 分钟视频准备 5-8 张分镜图(太多太赶、太少无聊)③ 加说明:标注景别(近景/全景)与运镜(推近/拉远/左右移) |
| 新手窍门 | 觉得从零生成难 → 先做一张满意的图,再让 AI 基于这张图生成连续后续画面,风格更统一 |
| 收尾 | 给每张分镜图编号 |
提示词万能公式:
【场景环境】+【角色动作】+【镜头描述】
❌ 反例:猫在桌子上
✅ 正例:教室全景(场景+镜头),一只猫跳上了书桌(角色动作)
② 动画生成
| 项目 | 内容 |
|---|---|
| 国际工具 | ~~Sora~~(已关停,见素材A)、Runway、Pika |
| 国产工具 | Vidu、即梦(Jimeng)、可灵(Kling)、海螺(Hailuo) |
| 选型建议 | 选一两个顺手的即可 |
| 做法 | 上传分镜图 + 角色素材 → 先从一个镜头开始生成 → 微调动作细节 → 加基础转场(淡入淡出、切换) |
| 检查三件事 | ① 走路是否顺、脚有没有”飘” ② 说话时表情是否对应情绪 ③ 转头抬手是否连贯 |
| 关键技巧 | 尽量用同一个工具完成同一条视频,混用容易”风格割裂” |
这篇文章最有价值的一点:“1 分钟视频准备 5-8 张分镜图”这个量化基准,以及“同一条视频尽量用同一个工具完成”——后者是被很多教程忽略但极其实用的经验。
适合什么人在什么阶段看:完全零基础的第一天。读完这篇就能动手做出第一条。
素材 E|《AI影视漫画怎么做的视频?AI工具帮你搞定剧本、角色、分镜、动态、后期全流程》
🔗 https://www.chooseai.net/news/1067/ |ChooseAI
五块积木:剧本 → 角色 → 分镜 → 动态 → 后期
① 剧本生成
- 工具:ChatGPT、豆包AI、Anime AI
- 结构化提示词:
故事类型 + 核心冲突 + 角色设定 + 场景关键词
热血校园剧,转学生发现同学是外星人,男主戴黑框眼镜,女主有猫耳,场景包含教室、天台、秘密基地
- 分镜细化用
镜头语言 + 动作描述:
中景:男主推眼镜,逆光下镜片反光,女主猫耳突然竖起(镜头右移展示窗外UFO轮廓)
② 分镜生成
| 步骤 | 工具 | 说明 |
|---|---|---|
| 1 | StoriaBoard | 输入文本自动识别场景角色,生成带运镜建议的分镜草图 |
| 2 | MidJourney | 选中关键画面生成高清版。提示词公式 角色动作+场景细节+风格参数+镜头语言,例:”女主手持激光剑跃起,火焰在身后燃烧,赛博朋克风格,低角度仰拍突出气势” |
| 3 | 即梦AI | 给静态分镜加”镜头平移””变焦”,生成 30 秒动态预演 |
③ 角色设计
| 步骤 | 工具 | 说明 |
|---|---|---|
| 1 | Comicai | 上传参考图 + 特征描述(如”18岁少女,银发双马尾,机械义眼,战斗服带齿轮装饰”),生成多套方案 |
| 2 | 即梦AI | 一致性控制:保存角色参数(肤色、发型代码)确保跨场景统一;崩图用”局部重绘”修正 |
| 3 | AnimeShorts | 输入”女主惊讶”自动生成口型同步、瞳孔收缩的表情动画 |
④ 场景搭建
| 工具 | 用途 |
|---|---|
| 通义万相 | 复杂场景生成(如”末日废土城市,摩天大楼倾斜,天空呈现紫色电离层”,带粒子特效的全景图) |
| 巨日禄 | 场景复用——批量生成同一场景不同角度(教室全景→黑板特写→窗外远景) |
| Runway ML | — |
这篇文章最有价值的一点:工具清单最丰富且按”积木”分类,尤其是 StoriaBoard(自动分镜草图)、Comicai(角色方案)、巨日禄(同场景多角度批量)——这三个工具在其他教程里都没出现,是很有价值的补充。
适合什么人在什么阶段看:想扩充工具箱、或某个环节卡住想换个工具试试时。当作”工具黄页”查即可。
素材 F|《AI漫剧订单暴涨14倍,我拆解了普通人赚钱全流程》
🔗 https://www.toutiao.com/article/7682037576450032168 |今日头条
四步流程 + 变现
① 选题:团宠、种田、古风爽文、穿越逆袭——短剧榜靠前的基本是这些。
② 写剧本(豆包或 DeepSeek,免费):
帮我写一个古风种田漫剧的3分钟脚本,主角是穿越成弃妇的现代女医生,她在边疆开荒种地,靠医术逆袭。分3集,每集结尾留悬念。
几分钟出完整剧本(含分镜描述、角色设定、场景安排)。
坑:AI 写的剧本千篇一律,直接用很难爆,必须自己改——加反转、改台词、调节奏。AI 是出初稿的,不是替你做决定的。
③ 生成画面(即梦AI 或 可灵AI,免费):
古风女子在田间劳作,远处是边关城墙,夕阳西下
几十秒出 4 张图选最好的。3 分钟漫剧约需 15-20 张图,熟练 1 小时生成完。实测第一次生成 5 张图只有 2 张质量不错——别指望一次到位。
④ 配音剪辑(剪映,免费):
- 导入图片,用”关键帧”功能做缓慢推拉效果
- 剪映自带 AI 配音
- 字幕一键识别
- BGM 从剪映音乐库选
- 只需会用”导入””分割””加字幕”三个功能
⑤ 发布与收益
| 平台 | 特点 |
|---|---|
| 抖音 | 开通创作收益权限后播放量直接换钱;S+ 级漫剧有保底 75 万播放量扶持 |
| 快手 | — |
| 红果短剧 | 分成比例高,新人有激励奖金 |
| 视频号 | — |
发布打标签:#AI漫剧 #短剧 #AI创作
坑一:万播收益在跌。早期百万播放收益几百块,现在同样播放量可能只有几十块——做的人多了、分钱的人多了。但头部创作者月入十万的例子仍在,关键在内容质量。
这篇文章最有价值的一点:“3 分钟漫剧约需 15-20 张图、熟练 1 小时生成完”和”剪映只需会三个功能”——这两句话把门槛从”看起来很高”直接拉到”今晚就能做完”。同时它诚实地指出了万播收益在跌。
适合什么人在什么阶段看:想评估”这事值不值得干”以及”最短路径是什么”的人。
素材 G|《AI短剧制作全流程——成本几百块,3天出一部》
🔗 https://www.toutiao.com/article/7668673383726449167 |今日头条 · 帝听听问|2026-07-31
成本是真人剧的 1/5 到 1/4,制作周期从天级压到 3 天,一个人跑完全流程。
工具链(按环节分工)
| 环节 | 工具 | 作用 |
|---|---|---|
| 分镜 + 日常动作 | 即梦AI(Seedance 2.0) | 文字转视频,自动分镜 + 推拉摇移 |
| 特效 + 高动态镜头 | 可灵 Kling | 水流/烟雾/爆炸/武侠打斗,原生 1080P/4K |
| 音画同步 | 通义万相 Wan2.5 | 自动匹配音效、人声、口型 |
| 剪辑 + 配音 + 字幕 | 剪映 | 和即梦AI 深度打通,一键剪辑 |
3 天流程
| 天 | 任务 | 细节 |
|---|---|---|
| Day 1 | 剧本 + 分镜 | ChatGPT 写剧本 30 分钟出故事;即梦AI 生成每镜头画面 |
| Day 2 | 生成视频素材 | 日常动作用即梦;特效镜头用可灵(视频续写最长 2 分钟);数字人对白用通义万相 |
| Day 3 | 剪辑 + 发布 | 素材导入剪映自动加字幕配音、调节奏加 BGM、导出成片 |
分发渠道:红果短剧(流量最大、平台分成)、央视频(权威背书)、安徽卫视等卫视(上星播出、品牌溢价)。
变现路径:平台播放分成;品牌定制短剧(一条收 3000-10000 元);带货植入。
这篇文章最有价值的一点:“按环节分工具”的思路——不追求一个工具干完所有事,而是日常动作/特效/音画同步各用最擅长的工具。同时给出了品牌定制短剧 3000-10000 元/条的定价参考。
适合什么人在什么阶段看:已经跑通一遍、想压缩周期到 3 天的人。
素材 H|《AI漫剧制作全流程》(长文,2026年)
⚠️ 来源链接缺失(检索自公开内容平台)
这是本合集中最详细的零基础保姆级教程,含 2D 漫剧与 3D 仿真人双赛道。
概念与市场
- AI 漫剧 = 用 AI 把文字剧本转成连贯漫画画面 + 配音字幕动态特效
- 与真人短剧区别:画面是 AI 生成的漫画风格;与传统漫画区别:画面是动态的
- 主流画风三种:日系动漫风、国漫厚涂风、韩系半写实风
- 新手建议从日系动漫风入手——对 AI 生成容错率最高、角色一致性最好控制
赛道对比
| 2D 二次元漫剧 | 3D 仿真人短剧 | |
|---|---|---|
| 题材 | 古风、系统流、校园甜宠 | 豪门逆袭、悬疑复仇 |
| 单集耗时 | 30-45 分钟 | 50-70 分钟 |
| 成本 | 低(免费工具可完成) | 中等(数字人工具需会员) |
| 受众 | 学生、网文爱好者,流量更大 | 成年用户,短剧分销收益更高 |
| 难度 | 低,画风容错率高 | 中,需把控光影和人物一致性 |
| 适合题材 | 系统流/穿越/玄幻/校园 | 豪门/复仇/都市/悬疑 |
传统动画团队一集需 3-7 天,AI 流水线压缩至 60 分钟单集成片。
七步流程
第一步 剧本创作
新手最大误区:一上来就打开绘图工具。画面依附故事。
AI 漫剧剧本更依赖旁白驱动(漫画画面表现力有限,心理活动、场景转换、时间跳跃靠旁白衔接)。
单集建议 60-90 秒、8-12 个镜头。
你是一位资深AI漫剧编剧,擅长快节奏、强情绪的竖屏漫剧创作。
【题材】:______(如:古风复仇/都市甜宠/悬疑推理)
【核心设定】:______(一句话概括故事核心矛盾)
【主角】:姓名/年龄/身份/性格/核心欲望
【集数与时长】:共__集,每集60-90秒,8-12个镜头
创作要求:
每集前10秒必须有强钩子(冲突/反转/悬念)
每集结尾必须留悬念,引导看下一集
旁白占比40%,对白占比60%,旁白用于心理活动和场景过渡
对白简短有力,单句不超过15字
每集至少1个情绪转折点
输出格式:集数 + 场景 + 人物 + 动作 + 对白 + 旁白
工具:豆包、DeepSeek、Kimi。第一版出来后重点检查三件事:人物关系是否清晰、冲突节奏是否够密、旁白与对白比例是否合理。不满意就逐段修改,不要整段重写。
第二步 角色与场景资产(90% 新手翻车的地方)
每个核心角色需要:正面定妆照(胸像)、侧面照、全身照、角色三视图(正面+侧面+背面)、2-3 个关键表情。
【角色名】:苏晚
【年龄】:22岁
【画风】:日系动漫风格,赛璐璐上色
【外貌】:鹅蛋脸,琥珀色大眼睛,长睫毛,小翘鼻,樱花色嘴唇
【发型】:银灰色长直发,齐刘海,发尾微卷
【服装】:白色古风长裙,腰间系蓝色丝带,袖口绣银色花纹
【体型】:身高165cm,纤细
【性格关键词】:清冷、坚韧、内心柔软
【配饰】:左耳戴一枚蓝色耳坠
工具:即梦、Midjourney、LiblibAI。选定最满意的一张作”基准图”,后续所有镜头以它为参考。进阶:训练角色 LoRA 或用 IP-Adapter、InstantID 把特征”焊死”。场景同理,核心场景也先出一张”基准场景图”。
第三步 分镜拆解
合格漫剧分镜需包含:景别、人物动作与表情、镜头运动、环境氛围、对应台词或旁白。
三个关键原则:
1. 复杂动作拆成多格 —— “角色拔剑挥砍”拆成:手按剑柄特写→拔剑中景→挥砍近景→对手后退全景;每镜头 3-5 秒,比一个长镜头稳定得多
2. 情绪用特写放大 —— 愤怒给眼睛特写,悲伤给嘴角颤抖特写,比中景更有冲击力
3. 旁白对应空镜 —— 飘落花瓣、移动云影,不浪费角色资源又营造氛围
你是一位资深漫画分镜师,请将以下剧本段落拆解为分镜头脚本。
【剧本段落】:______
【角色基准】:______(粘贴角色设定)
【场景基准】:______(粘贴场景设定)
【画风】:日系动漫 / 国漫厚涂 / 韩系半写实
每个分镜输出:镜号 / 景别(特写/近景/中景/全景/远景)/ 画面描述(人物动作+表情+构图+环境细节)/ 镜头运动(固定/缓慢推近/平移/缩放)/ 时长(秒)/ 对应台词或旁白 / 音效提示
要求:每个镜头3-5秒,单镜头动作单一明确,情绪节点用特写强调。
分镜拆得越细,后面返工越少,这一步花的时间后面能省回三倍。
第四步 画面生成(先静后动)
核心原则先静后动——先生成每镜静态关键帧确认无误再做动态化。直接文生视频可控性太低,不建议新手使用。
| 工具 | 特点 |
|---|---|
| 即梦 | 中文理解好、国风质量高、免费额度足 |
| Midjourney | 画风多样质感顶级,但需科学上网 |
| LiblibAI | 国内、模型丰富、支持 LoRA 训练 |
| Stable Diffusion(本地) | 自由度最高 |
三个技巧:① 用基准图做参考,提示词加”保持角色形象一致” ② 统一画风后缀,每条提示词末尾固定加画风描述(如”日系动漫风格,赛璐璐上色,干净线条,柔和光影,高画质”)③ 批量生成择优,每镜生成 4-8 张备选
第五步 动态化
| 方案 | 工具 | 操作 |
|---|---|---|
| 方案一:AI 图生视频(推荐) | 可灵、即梦视频、Vidu、Pika、Runway | 上传静态图 → 输入运动描述(如”人物缓慢转头,眼神从冷漠变为惊讶,镜头缓慢推近”)→ 生成 3-5 秒片段 |
| 方案二:剪辑软件做简易动态(零成本) | 剪映 | 给静态图加关键帧动画:缓慢缩放(110%→100% 模拟推镜)、缓慢平移(模拟摇镜)、加抖动转场增强节奏 |
方案二是”伪动态”,不如 AI 自然但零成本零门槛,适合试水。
逐个检查:动作是否自然、有无畸形穿模、镜头运动是否流畅。
第六步 配音配乐与后期
漫剧的情绪张力至少一半来自声音。同样画面配平淡 AI 朗读和有情绪起伏的配音,完播率能差一倍。
| 项目 | 做法 |
|---|---|
| 工具 | 剪映AI配音、豆包语音合成、ElevenLabs |
| 音色 | 旁白用沉稳音色,对白按角色性格选音色 |
| 语速 | 调至 0.9 倍更自然 |
| 语气 | 关键台词加重语气,不要全程平铺 |
| 配乐 | 古风剧:古筝+笛子;甜宠剧:钢琴+弦乐;悬疑剧:低频电子音 |
| BGM 音量 | 控制在人声的 20%-30% |
| 音效 | 拔剑声、脚步声、风声、心跳声(可用豆包音效生成) |
| 剪辑 | 全程硬切不要淡入淡出;每 3-5 秒一个镜头切换 |
| 字幕 | 黑体、字号适中、加描边;旁白与字幕严格对齐 |
第七步 发布与数据迭代
| 数据 | 阈值 | 诊断 |
|---|---|---|
| 3 秒完播率 | < 50% | 开头钩子不够硬 |
| 整体完播率 | < 30% | 节奏有问题 |
| 互动率(点赞+评论+转发) | < 3% | 情绪共鸣不够 |
平台:抖音(流量最大,主阵地)、快手、红果漫剧(字节专门的漫剧平台,有付费分成机制)、小红书。
评论区是金矿——观众在猜什么剧情、喜欢哪个角色、吐槽哪里不合理,都是下一集创作方向。
2D 专用提示词模板
角色基准图:
古风少女,清冷五官,白色汉服,长发束起,8K超清,国漫二次元,柔和天光,干净背景,全身立绘,三视图(正面、侧面、背面),统一五官特征,无畸变
即梦上传三视图锁定角色 ID,后续分镜自动复用面部特征。
2D 动态漫动作指令:
镜头缓慢向前推进,女主抬头落泪,发丝随风飘动,衣服轻微起伏,自然眨眼,10秒动态,流畅动画,无闪烁崩坏
转场处理:镜头切换中间生成过渡片段。
3D 仿真人:即梦3D片场、可灵3D数字人(自带灯光机位虚拟场景);专业量产用硅基智能、HeyGen、Seedance 2.0(锁定真人数字人,百集不换脸);动态视频用 Pika 3.0、Runway Gen3(3D 镜头推拉环绕、人物自然动作)。口型同步:提前导入本镜台词音频,AI 自动匹配嘴唇开合。
通用提示词结尾(直接粘贴):
8K 超清,电影级光影,细节拉满,无畸形五官,无扭曲肢体,画面干净,竖屏 9:16,PBR 材质,细腻纹理,景深虚化
网文转短剧提示词(可直接复制)
你是专业竖屏漫剧编剧,将下面小说章节改编为60-90秒单集剧本,遵循爆款结构:
0-3秒强冲突钩子,中段快速推进剧情,结尾留反转悬念;
拆分为8-12个镜头,每个镜头标注:序号、景别、运镜、画面描述、人物台词、时长;
区分2D古风漫剧/3D写实仿真人两种画面描述,文字简洁适配AI绘图,删除冗余心理描写。
小说原文:【粘贴你的网文内容】
7 天落地路线
| Day | 任务 |
|---|---|
| Day1 | 赛道定位 + 领番茄免费网文IP + 拆解 3 部对标爆款 |
| Day2 | 练 AI 写分镜脚本 |
| Day3 | 2D 角色生成 + 锁定不换脸 |
| Day4 | 3D 仿真人捏人 + 3D 片场机位灯光 |
| Day5 | 图生视频批量生成,解决闪烁畸形 |
| Day6 | 配音音效剪辑全流程,产出第一版粗片 |
| Day7 | 调色封面优化 + 发布复盘 + 固化个人 SOP |
版权合规:优先走官方授权渠道(抖音创作者中心→短剧版权中心,番茄百万网文 IP 免费申请改编),无授权小说禁止商用发布。
这篇文章最有价值的一点:“先静后动”原则和”基准图”工作流,加上三个可诊断的数据阈值(3秒完播率 50% / 整体完播率 30% / 互动率 3%)。它还第一次明确指出”直接文生视频可控性太低,不建议新手使用”——这条能帮新手省下大量无效抽卡。
适合什么人在什么阶段看:这是本合集的主线教程,零基础应该以这篇为骨架,其他篇作为补充。
素材 I|《7种角色一致性方案》(专题长文)
⚠️ 来源链接缺失(检索自公开内容平台,火星人教育公众号内容)
痛点数据:76% 的 AI 短剧创作者把”角色变脸”列为第一大痛点。
为什么会变脸(三句话):
- 随机种子不同 → 结果不同:AI 视频生成模型是无状态的,每次生成独立运行,不保留角色记忆
- 描述模糊 → 结果不同:”年轻女性”有无数种长相
- 场景变化 → 结果不同:光线角度一变,模型重新”理解”角色
7 种方案(按难度从低到高)
| # | 方案 | 一致性与门槛 | 核心做法 | 优点 | 缺点 | 适用场景 |
|---|---|---|---|---|---|---|
| 1 | 图生视频参考图驱动 | 高 / 低 | 先出角色定妆照,后续所有镜头以它为参考,提示词只写动作和场景 | 一致性最高、操作最简单、无需技术基础 | 动作和角度受参考图限制,侧面/远景匹配度约 55% | 新手起步、正面镜头为主的短剧 |
| 2 | 角色卡片 + 外貌锚点 | 中高 / 低 | 建立固定角色文字档案,每个镜头提示词开头粘贴完全相同的角色描述段落 | 灵活度高、不受参考图限制、零成本 | 一致性不如图生视频,细节有偏差 | 需要多角度、多场景 |
| 3 | 固定种子值 | 中 / 低 | 可灵 API 等支持 seed 参数的平台设固定种子值,同场景多镜头共用 | 简单 | 种子能提高相似性但不能替代参考图,场景动作变化大时人物仍会漂移 | 同场景批量生成,作辅助手段叠加 |
| 4 | AI 换脸后期处理 | 极高 / 中 | 生成时不管一致性,后期统一用 AI 换脸工具把所有镜头角色面部替换为同一张脸(ReActor / InstantID) | 一致性极高、生成阶段零额外成本 | 需额外后期步骤,换脸不自然需二次修复 | 对话密集型短剧、已拍完需补救、Veo3 后期统一 |
| 5 | LoRA 角色模型训练 | 最高 / 高 | 20-50 张不同角度/表情/光线的角色照片,用 Kohya 训练(推荐 rank 32-64),生成时加载 LoRA,strength 0.7-1.0 | 一致性最高(0.90+),训练一次终身受益 | 每角色 5-8 小时训练;过拟合则僵化、欠拟合等于没训 | 长期 IP 运营、固定角色反复使用、有技术团队的工作室 |
| 6 | ComfyUI IP-Adapter 多视图工作流 | 高 / 高 | IP-Adapter FaceID + 角色 LoRA + ControlNet 三重锁定 | 灵活度最高、控制最精细、天花板最高 | 搭建 2-3 天,需 12GB+ 显存和 ComfyUI 经验 | 专业工作室、对可控性要求极高 |
| 7 | 全流程管线角色引擎 | 高 / 中 | 在模型外层包一层角色管理系统,由系统”记住”角色信息,每次调用自动注入角色约束(代表平台 LumenLine 等) | 设定一次贯穿全剧、零训练时间、可跨项目复用 | 参数颗粒度不如 ComfyUI 自建、依赖平台生态 | 无代码基础、月产 1-2 部 |
方案 1 定妆照提示词(可直接复制)
Portrait photo of a young Chinese woman, 25 years old, oval face, long straight black hair past shoulders, small mole below left eye, white silk blouse, gentle confident expression, studio lighting, clean background, front-facing
方案 2 外貌锚点示例(可直接复制)
角色C01,25岁亚洲女性,鹅蛋脸,杏仁眼,右眼下方浅色小痣,黑色齐肩直发,三七侧分,银色圆形耳环
⚠️ 注意:不要把”齐肩直发”改成”中长发”,不要交替使用”清秀””妩媚”等主观词——每个词都会导致模型重新推断面部。
方案 5 LoRA 训练数据要求:正面、左右侧面、¾侧脸、不同表情、不同光线,越多样越稳定。
方案 6 参数调节参考
| 目标 | IP-Adapter FaceID | 角色 LoRA | ControlNet |
|---|---|---|---|
| 默认配置 | weight 0.75 | strength 0.8 | OpenPose |
| 面部精度优先 | 0.9 | 0.6 | — |
| 自然变化优先 | 0.7 | 0.8 | — |
| 特定姿态 | 0.75 | 0.8 | 0.8-1.0 |
实测数据对比(16 集短剧 / 400 镜头)
| 方案 | 一致性得分 | 设定耗时 | 技术门槛 |
|---|---|---|---|
| 参考图 | 0.67 | 约 10 分钟 | 低 |
| LoRA 微调 | 0.91 | 约 7 小时 | 高 |
| 管线引擎 | 0.88 | 约 30 分钟 | 低 |
| ComfyUI 自建 | 0.90 | 约 3 天 | 极高 |
4 个辅助技巧
| 技巧 | 做法 |
|---|---|
| ① 服装锚点法 | 固定服装让观众凭服装识别同一角色。为每场景设定固定服装编号(如 C01-A 日常 / C01-B 夜景),分镜表直接填编号 |
| ② 快速剪辑法 | 每镜头 2-4 秒快速切换,观众来不及观察面部差异;双人对话用正反打分别生成 |
| ③ 统一调色法 | 色调差异会放大不一致感,全片统一后期调色 |
| ④ 剪辑过渡法 | 面部差异大的镜头避免连续放置,中间插入环境空镜或他人反应镜头过渡 |
按人群选型建议
| 你的情况 | 推荐方案 |
|---|---|
| 新手第一次做短剧 | 方案 1(图生视频) |
| 对话密集型 | 方案 1 + 方案 4(换脸) |
| 月产 1-2 部、无代码基础 | 方案 7(管线引擎) |
| 月产 3 部+、有技术团队 | 方案 5 + 方案 6(LoRA + IP-Adapter) |
| 固定 IP 长期运营 | 方案 5(LoRA 训练) |
| 已拍完需补救 | 方案 4(换脸) |
核心结论:角色一致性是 AI 短剧的”生死线”——观众能接受画面略差,但主角突然换人立刻出戏。先锁定角色再开拍,不要拍完再补。
这篇文章最有价值的一点:唯一的量化横评(一致性得分 / 设定耗时 / 门槛三维度实测),让你能按自己的产能和技术水平直接选型,而不是凭感觉试错。
素材 J|《AI短剧·漫剧实战从0到1》系列
🔗 腾讯 ima 知识库收录(https://ima.qq.com/wiki/ ,具体文章页 URL 不稳定,未编造精确链接)
七步工作流
| 步 | 环节 | 要点 |
|---|---|---|
| ① | 写剧本 | 豆包或 Claude;结构”钩子—发展—反转—收尾“;单集 500-1200 字;题材选市场验证过的——末世、甜宠、悬疑、修仙 |
| ② | 拆分镜表 | 每段标注:段号、画面内容、对白、景别、运镜、情绪;一段一个主动作 |
| ③ | 定角色设定图 | 即梦或 NanoBananaPro 生成,锁定种子值 |
| ④ | 写提示词 | 公式见下 |
| ⑤ | Seedance 2.0 逐段出视频 | 9:16 竖屏;上传角色参考图锁脸;每段出 3-5 条挑最好的 |
| ⑥ | 剪映拼接 | 按分镜顺序,硬切为主;加配音 BGM 字幕 |
| ⑦ | 发布 | 红果短剧、抖音、快手,哪个有扶持先投哪个 |
提示词公式
主体 + 动作 + 场景 + 光影 + 镜头语言 + 风格 + 画质 + 约束
每段重复风格词画质词;角色段加”同一角色,服装一致,发型不变“。
关键提醒(原文)
- AI 短剧爆款几乎都是网文 IP 改编,因为故事本身经过千万读者市场验证;原创前先去番茄小说看什么题材在火。
- 角色一致性反复检查,每段都要引用同一张参考图。
- 镜头时长会失控——剧本写 3 秒,工具可能自动补成 10 秒 15 秒,成片时长翻倍,只能后期手剪。
- 别一上来追求完美,先用 huobao-drama 这类全自动工具跑通一遍,再逐环节优化。
行业观察(原文)
重庆某从业者称其认识的近 10 家短剧公司里还在做真人实拍的只剩两三家,有一家直接砍了导演岗位全转 AI。
窗口期有保质期——平台还在砸钱扶持、工具还在迭代、审核细则未完全落地;等头部内容工厂产能拉满、平台补贴退潮、监管收紧,单打独斗的空间会快速收窄。
这篇文章最有价值的一点:“镜头时长会失控”和”先用全自动工具跑通一遍再逐环节优化”这两条。前者是新手最容易懵的地方(写 3 秒出 15 秒),后者是最高效的学习路径。
素材 K|《流程|4步做出一部AI短剧》(拆解彭青云案例)
🔗 腾讯 ima 知识库收录(https://ima.qq.com/wiki/ ,具体文章页 URL 不稳定,未编造精确链接)
4 步闭环:AI生成剧情 → AI生成视频 → AI配音 → 全网分发
工具链总成本约 2000~5000 元/月,一个人即可完成。
| 步 | 工具 | 耗时 | 关键 |
|---|---|---|---|
| 1 AI 生成短剧剧本 | ChatGPT / Claude | 一部剧本约 1~3 天 | 创意 + 审美是核心能力,AI 只是把想法变成文字 |
| 2 AI 生成视频画面 | 可灵AI / 即梦AI(国产)+ Midjourney(角色图/分镜)+ ~~Sora~~(特效场景,已关停) | — | 先 MJ 出角色概念图 → 再可灵/即梦生成动态视频 → ~~Sora~~ 做特效。分镜设计和叙事节奏决定短剧质量,这是 AI 替代不了的核心能力 |
| 3 AI 配音 + 数字人 | HeyGen / D-ID(数字人)+ 剪映AI(配音/字幕) | — | 出海短剧需要多语种配音,AI 配音成本接近零 |
| 4 全网分发 | — | — | — |
从业者原话
“以前在开放式办公区接受任务分发,现在在小隔间里掌握项目全流程。虽累但’掌控’。”
这篇文章最有价值的一点:2000~5000 元/月的工具链成本基准,以及”创意+审美是核心能力”的定位——它把这件事的本质说清楚了:AI 是产能杠杆,不是创意替身。
三、横向整合:一条通用的 AI 短剧 / 漫剧 SOP
把 11 篇的流程对齐合并后,得到下面这条八环节流水线。每个环节标注了耗时估算、主流工具、成功判据。
① 选题立项 → ② 剧本 → ③ 角色与场景资产 → ④ 分镜拆解
→ ⑤ 静态关键帧生成 → ⑥ 动态化 → ⑦ 配音配乐与后期 → ⑧ 发布与迭代
总览表
| 环节 | 耗时估算 | 主流工具 | 成功判据(过了才往下走) | 主要出处 |
|---|---|---|---|---|
| ① 选题立项 | 0.5-1 天 | 番茄小说、抖音/红果榜单 | 选定一个市场验证过的题材;拆解 3 部对标爆款 | H、J、F |
| ② 剧本 | 0.5-3 天 | 豆包、DeepSeek、Kimi、Claude、ChatGPT | 单集 60-90 秒 / 500-1200 字 / 8-12 镜头;前 10 秒有强钩子;结尾留悬念 | H、A、J、K |
| ③ 角色与场景资产 | 1-3 小时 | 即梦、Midjourney、LiblibAI、NanoBananaPro、Comicai;进阶用 LoRA / InstantID / IP-Adapter | 每个角色有三视图 + 基准图;核心场景有基准场景图 | H、I、A、E、C |
| ④ 分镜拆解 | 1-3 小时 | LLM(Claude / 豆包)+ StoriaBoard | 每镜 3-5 秒、单一动作、标注景别与运镜;1 分钟视频 5-8 张分镜 | H、C、B、D、J |
| ⑤ 静态关键帧生成 | 1-4 小时 | 即梦、MJ、SD/ComfyUI、LiblibAI | 先静后动;每镜 4-8 张备选择优;画风后缀统一 | H、C、B、A |
| ⑥ 动态化 | 2-6 小时 | Seedance 2.0/2.5、可灵 3.0、即梦视频、Vidu、Runway、Pika;零成本方案用剪映关键帧 | 每段 3-5 秒;每段出 3-5 条挑最好;无畸形闪烁 | A、C、G、H、J |
| ⑦ 配音配乐与后期 | 2-4 小时 | 剪映、ElevenLabs、豆包语音、Audition、DaVinci | 人声有情绪起伏;BGM 不盖人声;字幕对齐;硬切为主 | H、B、C、F |
| ⑧ 发布与迭代 | 0.5 天 + 持续 | 抖音、快手、红果短剧、视频号、小红书 | 3 秒完播率 >50%、完播率 >30%、互动率 >3% | H、F、G、J |
三种产能档位的排期参考
| 档位 | 适用 | 总周期 | 说明 |
|---|---|---|---|
| 极速版 | 一个人、试水 | 3 天 | 素材 G 方案:Day1 剧本+分镜,Day2 出素材,Day3 剪辑发布 |
| 标准版 | 一个人、稳定产出 | 5-7 天 | 素材 H 的 7 天落地路线;或素材 F 的”3 分钟漫剧 15-20 张图、熟练 1 小时生成”叠加前后期 |
| 团队/量产版 | 3-5 人工作室 | 60 分钟单集成片 | 素材 H:AI 流水线压缩至 60 分钟/集;素材 A 的六阶段流水线 + 一体化平台(周期缩短 80% 以上) |
极速版详细排期(素材 G 方案)
| 天 | 任务 | 工具 |
|---|---|---|
| Day 1 | 剧本(ChatGPT 30 分钟出故事)+ 分镜画面 | ChatGPT + 即梦AI |
| Day 2 | 生成视频素材:日常动作用即梦;特效镜头用可灵(视频续写最长 2 分钟);数字人对白用通义万相 | 即梦 + 可灵 + 通义万相 Wan2.5 |
| Day 3 | 剪辑 + 发布:导入剪映自动加字幕配音、调节奏加 BGM、导出成片 | 剪映 |
每个环节的”卡住了怎么办”速查
| 卡在哪 | 去看 | 一句话解法 |
|---|---|---|
| 不知道做什么题材 | 素材 F、J、H | 去番茄小说 / 榜单看什么在火;优先选市场验证过的(末世、甜宠、悬疑、修仙、团宠、种田、古风爽文、穿越逆袭) |
| 剧本写不出来 / 写出来很平 | 素材 F、H | AI 只出初稿,必须自己加反转、改台词、调节奏;逐段修改不要整段重写 |
| 角色老变脸 | 素材 I 第五章 | 先锁定角色再开拍:三视图 + 基准图 + 每段引用同一参考图 |
| 画面好看但拼起来像幻灯片 | 素材 B | 检查景别连续性、动作连贯性、情绪递进;用提示词控制”虚拟摄像机” |
| 抽卡太多、成本爆 | 素材 A、J | 先静后动(素材 H);每段 3-5 条即止;用”三步省 Token 法” |
| 动作抽搐 / 闪烁 | 素材 C、H | Motion Scale 降到 3-4、CFG 提到 7-8;动作描述保持单一;降低动态强度、统一每帧光影参数 |
| 成片时长失控 | 素材 J | 工具可能把 3 秒自动补成 10-15 秒,只能后期手剪 |
| 完播率低 | 素材 H | 看 3 秒完播率 / 整体完播率 / 互动率三个阈值定位问题 |
四、提示词模板合集
所有模板均保持原文可复制状态。冲突参数见本章末尾”参数冲突对照”。
4.1 剧本生成
① 竖屏漫剧剧本(素材 H)
你是一位资深AI漫剧编剧,擅长快节奏、强情绪的竖屏漫剧创作。
【题材】:______(如:古风复仇/都市甜宠/悬疑推理)
【核心设定】:______(一句话概括故事核心矛盾)
【主角】:姓名/年龄/身份/性格/核心欲望
【集数与时长】:共__集,每集60-90秒,8-12个镜头
创作要求:
每集前10秒必须有强钩子(冲突/反转/悬念)
每集结尾必须留悬念,引导看下一集
旁白占比40%,对白占比60%,旁白用于心理活动和场景过渡
对白简短有力,单句不超过15字
每集至少1个情绪转折点
输出格式:集数 + 场景 + 人物 + 动作 + 对白 + 旁白
② 网文转短剧(素材 H)
你是专业竖屏漫剧编剧,将下面小说章节改编为60-90秒单集剧本,遵循爆款结构:
0-3秒强冲突钩子,中段快速推进剧情,结尾留反转悬念;
拆分为8-12个镜头,每个镜头标注:序号、景别、运镜、画面描述、人物台词、时长;
区分2D古风漫剧/3D写实仿真人两种画面描述,文字简洁适配AI绘图,删除冗余心理描写。
小说原文:【粘贴你的网文内容】
③ 分镜级脚本(素材 C)
请扮演一位资深短剧编剧。我需要一个30秒的悬疑类短剧,主题是"镜中人的秘密"。请按以下格式输出:
[场景编号] – [时长] – [镜头类型]
画面描述:[用30-50字精确描述人物动作、表情、环境光效]
台词/旁白:[不超过20字]
音效提示:[如:滴水声、心跳声、关门声]
要求:每个场景的画面描述必须包含"可视觉化的动作",例如"手指颤抖着触碰镜面"而非"感到害怕"。
④ 古风种田题材示例(素材 F)
帮我写一个古风种田漫剧的3分钟脚本,主角是穿越成弃妇的现代女医生,她在边疆开荒种地,靠医术逆袭。分3集,每集结尾留悬念。
⑤ 结构化剧本(素材 E):故事类型 + 核心冲突 + 角色设定 + 场景关键词
热血校园剧,转学生发现同学是外星人,男主戴黑框眼镜,女主有猫耳,场景包含教室、天台、秘密基地
4.2 分镜拆解
① 分镜师模板(素材 H)
你是一位资深漫画分镜师,请将以下剧本段落拆解为分镜头脚本。
【剧本段落】:______
【角色基准】:______(粘贴角色设定)
【场景基准】:______(粘贴场景设定)
【画风】:日系动漫 / 国漫厚涂 / 韩系半写实
每个分镜输出:镜号 / 景别(特写/近景/中景/全景/远景)/ 画面描述(人物动作+表情+构图+环境细节)/ 镜头运动(固定/缓慢推近/平移/缩放)/ 时长(秒)/ 对应台词或旁白 / 音效提示
要求:每个镜头3-5秒,单镜头动作单一明确,情绪节点用特写强调。
② 8 要素分镜提示词(素材 A)
CHARACTER(角色) + BACKGROUND(背景) + ACTION(动作) + SCENE(场景) + CAMERA(镜头) + LIGHT(光线) + TEXT(文字) + STYLE(风格)
③ 万能分镜公式(素材 D)
【场景环境】+【角色动作】+【镜头描述】
④ 镜头语言 + 动作描述(素材 E)
中景:男主推眼镜,逆光下镜片反光,女主猫耳突然竖起(镜头右移展示窗外UFO轮廓)
4.3 角色设定
① 角色档案模板(素材 H)
【角色名】:苏晚
【年龄】:22岁
【画风】:日系动漫风格,赛璐璐上色
【外貌】:鹅蛋脸,琥珀色大眼睛,长睫毛,小翘鼻,樱花色嘴唇
【发型】:银灰色长直发,齐刘海,发尾微卷
【服装】:白色古风长裙,腰间系蓝色丝带,袖口绣银色花纹
【体型】:身高165cm,纤细
【性格关键词】:清冷、坚韧、内心柔软
【配饰】:左耳戴一枚蓝色耳坠
② 外貌锚点(素材 I) —— 每个镜头提示词开头粘贴,一字不改
角色C01,25岁亚洲女性,鹅蛋脸,杏仁眼,右眼下方浅色小痣,黑色齐肩直发,三七侧分,银色圆形耳环
③ 定妆照提示词(素材 I)
Portrait photo of a young Chinese woman, 25 years old, oval face, long straight black hair past shoulders, small mole below left eye, white silk blouse, gentle confident expression, studio lighting, clean background, front-facing
④ 角色参考图(素材 B)
a young woman, 25 years old, short black hair, wearing a beige trench coat, photorealistic, cinematic lighting --ar 2:3 --v 6.1
⑤ 2D 角色基准图 / 三视图(素材 H)
古风少女,清冷五官,白色汉服,长发束起,8K超清,国漫二次元,柔和天光,干净背景,全身立绘,三视图(正面、侧面、背面),统一五官特征,无畸变
⑥ 有辨识度的脸(素材 C,解决”网红脸”)
a middle-aged man with a scar on left eyebrow, tired eyes, five o'clock shadow
4.4 生图
① MJ 参数化提示词(素材 C)
A hand with visible veins trembling, reaching toward a fogged mirror, cold white bathroom light, condensation droplets on glass, shallow depth of field, cinematic lighting, horror atmosphere, shot on Arri Alexa 35 --ar 16:9 --style raw --s 250 --v 6
② 通用提示词结尾(素材 H,直接粘贴)
8K 超清,电影级光影,细节拉满,无畸形五官,无扭曲肢体,画面干净,竖屏 9:16,PBR 材质,细腻纹理,景深虚化
③ 通用提示词公式(素材 J)
主体 + 动作 + 场景 + 光影 + 镜头语言 + 风格 + 画质 + 约束
④ 统一画风后缀(素材 H)
日系动漫风格,赛璐璐上色,干净线条,柔和光影,高画质
⑤ 虚拟摄像机(素材 B)
| 目的 | 提示词 |
|---|---|
| 低角度仰拍 | low angle shot, looking up + --ar 9:16 |
| 过肩镜头 | over the shoulder shot, focus on subject + --iw 2 |
| 主观视角 | POV shot, first person view, hands visible in frame |
| 航拍俯视 | top-down view, bird's eye perspective + --ar 16:9 |
⑥ 情绪色彩系统(素材 B)
| 情绪 | 提示词 |
|---|---|
| 紧张 | cold blue and gray palette, high contrast, harsh shadows |
| 回忆 | sepia tone, warm glow, soft focus, film grain |
| 反转 | sudden burst of red, dramatic lighting, rim light |
⑦ 电影语言写法对比(素材 B)
❌ 一个人走路
✅ medium shot, tracking shot, man walking down corridor, dust particles in light, cinematic depth of field
⑧ 场景生成(素材 E)
末日废土城市,摩天大楼倾斜,天空呈现紫色电离层
4.5 图生视频
① 小云雀”沉浸式短片黄金公式”(素材 A)
[主体描述] + [画面运动描述] + [音效互动] + [台词] + [音色描述] + [运镜/环境] + [风格修饰] + [限定信息]
② Runway Gen-3 Alpha 运动描述(素材 C)
The character slowly turns head, rain drops on coat, subtle camera push-in
③ Kling 运动描述(素材 C)
walking in rain, wet pavement reflection, cinematic depth of field, slow motion
④ 2D 动态漫动作指令(素材 H)
镜头缓慢向前推进,女主抬头落泪,发丝随风飘动,衣服轻微起伏,自然眨眼,10秒动态,流畅动画,无闪烁崩坏
⑤ 通用运动描述(素材 H)
人物缓慢转头,眼神从冷漠变为惊讶,镜头缓慢推近
4.6 配音与后期
| 项目 | 参数 | 出处 |
|---|---|---|
| 语速 | 0.9 倍(更自然) | 素材 H |
| 语速 | 1.05 倍;短句停顿 0.2 秒 | 素材 H(后文”配音参数”段) |
| BGM 音量 | 人声的 20%-30% | 素材 H |
| BGM 音量 | 低于人声 30% | 素材 H(后文”配音参数”段) |
| 环境音效音量 | -18dB | 素材 B |
| 音色分配 | 女主温柔音 / 男主低沉音 / 旁白中性音 | 素材 H |
| 音色分配 | 中文推荐 Rachel / Adam 语音,导出 WAV | 素材 B |
| 配乐风格 | 古风:古筝+笛子;甜宠:钢琴+弦乐;悬疑:低频电子音 | 素材 H |
| 字幕字体 | 2D 用书法字体,3D 用简约黑体 | 素材 H |
| 导出参数 | 1080P、30 帧、MP4 | 素材 H |
主理人取舍建议:语速上,旁白用 0.9 倍、对白用 1.05 倍是个实用折中——旁白慢一点更沉稳,对白快一点更紧凑;也可以先统一按 1.0 倍生成,再按听感微调。BGM 音量上,两个说法其实指的是同一档位(人声的 20%-30% ≈ 比人声低约 30%),实操建议先设到 20%,导出后戴耳机听一遍,听不清人声就往下调。
五、角色一致性专题
这是所有教程公认的最大痛点。76% 的创作者把”角色变脸”列为第一大痛点(素材 I);素材 H 称其为”漫剧观众流失头号原因”。
5.1 为什么会变脸
AI 视频生成模型是无状态的,每次生成独立运行,不保留角色记忆。三个触发条件:
| 原因 | 说明 |
|---|---|
| 随机种子不同 | 同提示词、不同种子 → 不同结果 |
| 描述模糊 | “年轻女性”有无数种长相 |
| 场景变化 | 光线角度一变,模型重新”理解”角色 |
5.2 八种方案横向对比
前 7 种来自素材 I(按难度从低到高),第 8 种(ComfyUI 基础版)来自素材 C,作为入门补充。
| # | 方案 | 一致性 | 设定耗时 | 技术门槛 | 适用场景 | 出处 |
|---|---|---|---|---|---|---|
| 1 | 图生视频参考图驱动 | 高(实测 0.67) | 约 10 分钟 | 低 | 新手起步、正面镜头为主的短剧 | I |
| 2 | 角色卡片 + 外貌锚点 | 中高 | 几分钟(写一次) | 低 | 需要多角度、多场景、零成本 | I |
| 3 | 固定种子值 | 中 | 几秒 | 低 | 同场景批量生成,仅作辅助叠加 | I、J |
| 4 | AI 换脸后期处理(ReActor / InstantID) | 极高 | 每条后期 | 中 | 对话密集型、已拍完需补救 | I、B |
| 5 | LoRA 角色模型训练(Kohya) | 最高(实测 0.91) | 5-8 小时/角色 | 高 | 长期 IP 运营、固定角色反复使用 | I、A、B、H |
| 6 | ComfyUI IP-Adapter 多视图工作流 | 高(实测 0.90) | 约 3 天搭工作流 | 极高 | 专业工作室、可控性要求极高 | I、C |
| 7 | 全流程管线角色引擎(LumenLine 等) | 高(实测 0.88) | 约 30 分钟 | 低 | 无代码基础、月产 1-2 部 | I |
| 8 | ComfyUI InstantID + IP-Adapter(基础版) | 中高 | 数小时 | 中 | 本地部署用户,作为方案 6 的简化版 | C |
关键参数速查
| 方案 | 参数 |
|---|---|
| 1 参考图 | 三视图(正面+侧面+背面)+ 2-3 个关键表情;侧面/远景匹配度约 55% |
| 3 固定种子 | 可灵 API 等支持 seed 参数的平台 |
| 4 换脸 | SD 插件 ReActor v0.6.1(Face swap 模式)或 InstantID |
| 5 LoRA | 20-50 张多角度照片;Kohya 训练;rank 32-64;生成时 strength 0.7-1.0;一致性可达 97%(素材 A)/ 0.90+(素材 I) |
| 6 IP-Adapter 工作流 | FaceID 0.75 / LoRA 0.8 / ControlNet OpenPose;面部精度优先 0.9 + 0.6;自然变化优先 0.7 + 0.8;特定姿态 0.75 + 0.8 + ControlNet 0.8-1.0 |
| 8 InstantID + IP-Adapter | InstantID weight=0.8、start_at=0、end_at=0.4;IP-Adapter plus face、scale=0.6(短剧建议 0.5-0.7) |
其他教程补充的一致性手段
| 手段 | 说明 | 出处 |
|---|---|---|
| Master Reference 主参考图 | 每角色 3-5 张不同角度,存角色库 | A |
| StoryMem | 字节与南洋理工联合开发,存储关键帧并在后续场景参考 | A |
| 可灵 3.0 多镜头角色相似度 | 官方称 95%(2026-06 开放 API) | A |
| Seedance 2.0 锁定真人数字人 | 百集不换脸 | H |
| 即梦上传三视图锁定角色 ID | 后续分镜自动复用面部特征 | H |
| 即梦保存角色参数(肤色、发型代码) | 确保跨场景统一;崩图用”局部重绘”修正 | E |
| 基于上一张图续生成 | 先做一张满意的图,再让 AI 基于它生成连续后续画面 | D |
5.3 四个辅助技巧(低成本,立刻能用)
| 技巧 | 做法 | 出处 |
|---|---|---|
| ① 服装锚点法 | 固定服装让观众凭服装识别同一角色。为每场景设定固定服装编号(如 C01-A 日常 / C01-B 夜景),分镜表直接填编号 | I |
| ② 快速剪辑法 | 每镜头 2-4 秒快速切换,观众来不及观察面部差异;双人对话用正反打分别生成 | I |
| ③ 统一调色法 | 色调差异会放大不一致感,全片统一后期调色 | I |
| ④ 剪辑过渡法 | 面部差异大的镜头避免连续放置,中间插入环境空镜或他人反应镜头过渡 | I |
| ⑤ 统一画风后缀 | 每条提示词末尾固定加画风描述 | H |
5.4 按人群选型建议
| 你的情况 | 推荐方案 | 理由 |
|---|---|---|
| 新手第一次做短剧 | 方案 1(图生视频)+ 技巧①③⑤ | 10 分钟设定,一致性够用,零技术门槛 |
| 对话密集型短剧 | 方案 1 + 方案 4(换脸) | 正面镜头多,参考图够用;不放心再加一层换脸 |
| 月产 1-2 部、无代码基础 | 方案 7(管线引擎) | 30 分钟设定,一致性 0.88,可跨集跨项目复用 |
| 月产 3 部+、有技术团队 | 方案 5 + 方案 6(LoRA + IP-Adapter) | 天花板最高,一次投入长期摊薄 |
| 固定 IP 长期运营 | 方案 5(LoRA 训练) | 训练一次终身受益,一致性 0.90+ |
| 已拍完发现变脸、需补救 | 方案 4(换脸) | 唯一能救已生成素材的方案 |
| 本地部署 / ComfyUI 用户 | 方案 8 → 方案 6 | 先从 InstantID+IP-Adapter 入手,再升级到三重锁定 |
一句话结论:先锁定角色再开拍,不要拍完再补。
六、避坑清单
汇总各篇提到的坑,去重合并,按类别分类。
6.1 画面
| 坑 | 表现 | 解法 | 出处 |
|---|---|---|---|
| 角色变脸 | 主角突然换人,观众立刻出戏 | 先锁定角色再开拍;三视图 + 基准图 + 每段引用同一参考图 | H、I、J |
| 不锁定角色就开跑 | 90% 概率变脸 | 同上 | H |
| 一镜塞太多动作 | AI 处理不了复杂长镜头 | 复杂动作拆成多格(手按剑柄特写→拔剑中景→挥砍近景→对手后退全景) | H |
| 动作抽搐 / 闪烁 | 画面抖动 | ① 检查源帧清晰度 ② Motion Scale 降到 3-4 ③ CFG Scale 提到 7-8 ④ 动作描述保持”单一动作” ⑤ 降低动态强度、统一每帧光影参数 | C、H、A |
| 肢体扭曲 / 畸形穿模 | 四肢异常 | 提示词加”正常人体结构,四肢完整,无畸形” | H |
| 画面闪烁抖动(时序) | 帧间不连贯 | 时序平滑处理 | A |
| 画质不稳定 | 时好时坏 | 优化提示词 + 增加约束 | A |
| 风格不统一 | 各镜头画风割裂 | ① 建立统一风格参考图库 ② 统一画风后缀 ③ 同一条视频尽量用同一个工具完成 ④ IP-Adapter style reference scale 统一 0.6,negative prompt 保持一致 |
A、H、D、C |
| MJ 网红脸无辨识度 | 人物千篇一律 | 加具体特征(疤痕、疲惫眼神、胡茬);--s 降到 200 以下;或用 InstantID 固定人脸 |
C |
| 提示词只写人物不写光影运镜 | 画面质感廉价 | 补全光影、运镜、画质词 | H |
| 3D 仿真人不调灯光 | 画面扁平 | 用自带灯光机位的工具(即梦3D片场、可灵3D数字人) | H |
| 一次性生成全部分镜不单独校验 | 后期返工量大 | 先静后动,逐镜确认 | H |
| 画面比例选错 | 横屏素材直接发短视频,流量减半 | 竖屏 9:16 | H、J |
| 直接文生视频 | 可控性太低 | 新手先静后动,用图生视频 | H |
| Runway 超过 5 秒 | 画面扭曲 | 每段 2-3 秒后期拼接 | C |
| 源帧不清晰 | 后续全崩 | 静态关键帧阶段就择优 | C |
6.2 声音
| 坑 | 表现 | 解法 | 出处 |
|---|---|---|---|
| 配音敷衍 | 全程 AI 平铺朗读,完播率腰斩 | 声音情绪价值被低估,宁可画面简一点,配音不能平;关键台词加重语气 | H |
| BGM 音量盖过人声 | 观众直接划走 | 控制在人声的 20%-30% | H |
| 只用 BGM 不加音效 | 缺乏沉浸感 | 叠加两层音轨( Epidemic Sound / Artlist / Freesound.org / 豆包音效),环境音效 -18dB | C、B、H |
| 忽略音效 | 拔剑声、脚步声、风声、心跳声缺失 | 按分镜逐条补 | H |
| 旁白与字幕不对齐 | 观感割裂 | 严格对齐,手动润色字幕 | H |
6.3 节奏
| 坑 | 表现 | 解法 | 出处 |
|---|---|---|---|
| 单集超 2 分钟 | 完播率大幅下跌 | 单集控制在 60-90 秒 | H |
| 大量静态 PPT 式图片无动态运镜 | 平台限流 | 加 Ken Burns / 关键帧动画 / 图生视频 | H、B |
| 镜头时长失控 | 剧本写 3 秒,工具自动补成 10-15 秒,成片翻倍 | 只能后期手剪 | J |
| 忽略结尾悬念 | 追更率暴跌 | 每集结尾必留反转/悬念 | H、F |
| 开头钩子不够硬 | 3 秒完播率 < 50% | 前 10 秒必须有强钩子;前三秒放大冲突画面 + 醒目大字标题 | H |
| 转场硬切过度 | 观感跳 | 素材 C 建议溶解转场 0.3-0.5 秒;素材 H 建议全程硬切不要淡入淡出 —— 两者冲突,见下 | C、H |
冲突提示:素材 C 建议”转场避免硬切,用溶解转场 0.3-0.5 秒”;素材 H 建议”全程硬切不要淡入淡出”。
取舍建议:短剧/漫剧节奏快,主导意见是硬切(素材 H、J 均明确”硬切为主”)。溶解转场更适合素材 B 那种偏氛围、偏”漫剧电影感”的慢节奏作品。按你的赛道选:快节奏爽文用硬切,悬疑氛围向可少量用 0.3 秒溶解。
6.4 合规
| 坑 | 表现 | 解法 | 出处 |
|---|---|---|---|
| 无授权网文商用发布 | 侵权风险 | 优先走官方授权渠道(抖音创作者中心→短剧版权中心;番茄百万网文 IP 免费申请改编) | H |
| BGM、字体、素材不可商用 | 侵权风险 | 全部使用可商用素材 | H |
| AI 生成内容版权灰色地带 | 权属不清 | 角色原创、背景不用真实地标、标注 Generated by AI |
B |
6.5 成本与流程
| 坑 | 表现 | 解法 | 出处 |
|---|---|---|---|
| 成本过高 | 抽卡无止境 | ① 先小规模测试再批量 ② 先静后动减少无效抽卡 ③ 每段出 3-5 条即止 ④ 三分多钟样片可能需抽上百条,成本一般几百元、极致效果上千元 | A、H、J |
| 追求完美才发布 | 永远出不了片 | 先完成再完美 | H |
| 一上来追求完美技术栈 | 学习曲线陡峭 | 先用 huobao-drama 这类全自动工具跑通一遍,再逐环节优化 | J |
| 整段重写剧本 | 越改越乱 | 逐段修改 | H |
| 分镜拆得太粗 | 后期返工量大 | 分镜拆得越细,后面返工越少,这一步的时间后面能省回三倍 | H |
| 混用多个工具 | 风格割裂 | 同一条视频尽量用同一个工具完成 | D |
| 硬件不够 | 跑不动本地模型 | 最低 8GB 显存(RTX3070/3060/4050)+ 16GB 内存;不够用 Google Colab / RunPod(约 0.2 美元/小时)/ AutoDL / Colab Pro V100(约 10 美元/月) | B、A、C |
| 8G 显存跑 ComfyUI | OOM | --lowvram 启动;选 SD 1.5 而非 SDXL;batch_size=1;尺寸 512×512(后期 Topaz 超分) |
C |
| 万播收益在跌 | 同样播放量收益从几百块降到几十块 | 关键在内容质量;头部创作者月入十万的例子仍在 | F |
| 窗口期有保质期 | 平台补贴退潮、监管收紧后单打独斗空间收窄 | 尽早跑通闭环 | J |
6.6 终极避坑 10 条(素材 H 原文汇总)
- 无版权网文不要商用发布
- 角色不锁定直接生成,90% 概率变脸
- 单集超 2 分钟,完播率大幅下跌
- 提示词只写人物不写光影运镜,画面质感廉价
- BGM 音量盖过人声,观众直接划走
- 3D 仿真人不调灯光,画面扁平
- 一次性生成全部分镜不单独校验,后期返工量大
- 忽略结尾悬念,追更率暴跌
- 大量静态 PPT 式图片无动态运镜,平台限流
- 画面比例选错,横屏素材直接发短视频流量减半
七、新手学习路径建议
7.1 素材 H 的 7 天落地路线(推荐主线)
| Day | 任务 | 产出 |
|---|---|---|
| Day1 | 赛道定位 + 领番茄免费网文IP + 拆解 3 部对标爆款 | 选定题材,攒 3 部对标分析 |
| Day2 | 练 AI 写分镜脚本 | 1 集完整分镜表 |
| Day3 | 2D 角色生成 + 锁定不换脸 | 主角三视图 + 基准图 |
| Day4 | 3D 仿真人捏人 + 3D 片场机位灯光 | 3D 角色(可选,做 2D 可跳过) |
| Day5 | 图生视频批量生成,解决闪烁畸形 | 全部镜头片段 |
| Day6 | 配音音效剪辑全流程 | 第一版粗片 |
| Day7 | 调色封面优化 + 发布复盘 + 固化个人 SOP | 成片 + 你的个人 SOP |
7.2 素材 B 的 8 周导演能力路线(叙事/镜头语言专项)
| 阶段 | 任务 |
|---|---|
| 第 1-2 周 | 掌握 SD 的 ControlNet 和 ReActor,每天生成 20 组分镜练习 |
| 第 3-4 周 | 用 DaVinci 完成 3 部 1 分钟短剧,练 Ken Burns 和转场节奏 |
| 第 5-8 周 | 模仿经典电影开场(如《盗梦空间》旋转走廊)复现镜头语言 |
7.3 素材 A 的三档技术栈升级路径
| 档位 | 工具组合 | 适合 |
|---|---|---|
| 入门级 | 一站式平台(火山剧创 / 小云雀 / 万兴剧厂 / AniShort / 咪咕悦创) | 零基础,先跑通 |
| 进阶级 | Seedance + 剪映 + AI 配音 | 已跑通,追求质量与可控性 |
| 专业级 | ComfyUI 节点工作流 + 训练专属 LoRA | 工作室、长期 IP |
7.4 整合后的四阶段练习路线(建议按这个走)
| 阶段 | 目标 | 具体动作 | 判据 |
|---|---|---|---|
| 阶段一:跑通(1-2 周) | 完整做出第一条,不求质量 | ① 用素材 D 的”5-8 张分镜 / 1 分钟”基准做一条 1 分钟漫剧 ② 工具只用即梦 + 剪映 ③ 配音用剪映自带 | 能导出一条完整 MP4 |
| 阶段二:稳定(3-4 周) | 解决变脸和节奏 | ① 按素材 I 方案 1 建立角色三视图工作流 ② 按素材 H 做 60-90 秒单集、8-12 镜头 ③ 加 Ken Burns / 关键帧动画 | 3 秒完播率 > 50% |
| 阶段三:提质(1-2 月) | 画面与声音升级 | ① 学素材 B 的景别连续性、虚拟摄像机、情绪色彩 ② 配音按角色分配音色、调语速、控制 BGM 音量 ③ 尝试图生视频(可灵 / Seedance / Vidu) | 完播率 > 30%、互动率 > 3% |
| 阶段四:量产 / 专业化(2 月+) | 提效、降本、建 SOP | ① 切换到一体化平台(火山剧创 / 小云雀等)或自建 ComfyUI 工作流 ② 固定 IP 考虑训练 LoRA ③ 固化个人 SOP,按数据迭代 | 单集周期压到 1 天内 |
建议:阶段一务必”先完成再完美”(素材 H),并且先用 huobao-drama 这类全自动工具跑通一遍再逐环节优化(素材 J)。
八、行业数据速览
所有数据均标注出处素材。不同来源口径不同,未强行统一。
8.1 市场规模
| 数据 | 数值 | 出处 |
|---|---|---|
| 2024 年市场规模 | 不足 50 亿元 | H |
| 2025 年市场规模 | 168 亿元(同比 +276%);2025 被称为”AI漫剧爆发元年” | H |
| 2026 年 1-5 月市场规模 | 突破 220 亿元 | A |
| 2026 年全年预测 | 有望冲击 400 亿元 | A |
| 2026 年全年预测(艾媒咨询) | 243.6 亿元 | H |
| 2026 年全年预测(36氪) | 有望冲击 300 亿 | H |
8.2 产量与用户
| 数据 | 数值 | 出处 |
|---|---|---|
| 2025 年抖音端原生漫剧上线数 | 突破 6 万部,全年累计播放超 757 亿次 | H |
| 2026 年 1 月单月上线 AI 漫剧 | 超 1.4 万部 | H |
| 2026 Q1 上线微短剧 | 12.8 万部,其中 AI 微短剧 12.2 万部,占比超 95% | A |
| 2026 上半年 AI 短剧用户 | 突破 6 亿 | A |
| 2026 年仿真人剧占比 | 已增至 38% | A |
8.3 播放与爆款
| 作品 | 数据 | 出处 |
|---|---|---|
| 《万妖图录传第八季》 | 热度 8919 万居首 | A |
| 《风水之王》 | 播放超 3.7 亿、红果 110 万收藏 | A |
| 《李世民魂穿阿斗》 | 上线不到一个月全网播放破亿 | A |
| 《被裁掉的女孩》 | 累计播放破 2 亿 | A |
| 2026 年 7 月第二周 | AI 短剧首次实现”流量超车“——红果热播总榜前五占四席 | A |
8.4 成本与周期
| 项目 | 数据 | 出处 |
|---|---|---|
| 单部全流程 AI 参与出片 | 48 小时可出片 | H |
| 算力成本 | 低至 3000 元 | H |
| AI 流水线单集 | 60 分钟成片(传统动画团队一集需 3-7 天) | H |
| 整体成本对比 | 真人剧的 1/5 到 1/4 | G |
| 制作周期 | 从天级压到 3 天,一个人跑完全流程 | G |
| 工具链成本 | 约 2000~5000 元/月 | K |
| 《万兽独尊》 | 60 集约 4 万多字,5 人团队 8 天完成(传统需 3-6 个月) | A |
| 《霍去病》 | 3 人团队、3000 元算力、4 天,播放破百万 | A |
| 《重回高考》 | 四川苍溪县零基础团队 40 天完成,登新剧榜第 16 名 | A |
| 抽卡成本 | 一般几百元,极致效果上千元;三分多钟样片可能需抽上百条 | A |
| 主流模型单次时长 | 最多 15 秒 | A |
| 一体化平台提效 | 周期缩短 80% 以上(火山剧创 1.0) | A |
| 3 分钟漫剧图量 | 约 15-20 张图,熟练 1 小时生成完 | F |
8.5 变现
| 项目 | 数据 | 出处 |
|---|---|---|
| 抖音 | 开通创作收益权限后播放量直接换钱;S+ 级漫剧有保底 75 万播放量扶持 | F |
| 红果短剧 | 分成比例高,新人有激励奖金;字节专门的漫剧平台,有付费分成机制 | F、H |
| 品牌定制短剧 | 一条收 3000-10000 元 | G |
| 万播收益趋势 | 在跌——早期百万播放收益几百块,现在同样播放量可能只有几十块 | F |
| 头部创作者 | 月入十万的例子仍在,关键在内容质量 | F |
| ElevenLabs | 约 5 美元/月(可用微软 Azure 免费 TTS 替代) | B |
| 算力租赁 | RunPod 约 0.2 美元/小时;Colab Pro V100 约 10 美元/月 | B、C |
8.6 供给侧结构变化
重庆某从业者称其认识的近 10 家短剧公司里还在做真人实拍的只剩两三家,有一家直接砍了导演岗位全转 AI。(素材 J)
窗口期有保质期——平台还在砸钱扶持、工具还在迭代、审核细则未完全落地;等头部内容工厂产能拉满、平台补贴退潮、监管收紧,单打独斗的空间会快速收窄。(素材 J)
附录:参数与说法冲突对照表
| # | 冲突项 | 说法 A | 说法 B | 主理人取舍建议 |
|---|---|---|---|---|
| 1 | 语速 | 0.9 倍更自然(H) | 1.05 倍,短句停顿 0.2 秒(H 后文) | 旁白 0.9 倍、对白 1.05 倍;或先按 1.0 生成再按听感调 |
| 2 | BGM 音量 | 人声的 20%-30%(H) | 低于人声 30%(H 后文) | 实为同一档位。先设 20%,戴耳机复听后微调 |
| 3 | 转场 | 硬切,不要淡入淡出(H、J) | 溶解转场 0.3-0.5 秒,避免硬切(C) | 快节奏爽文用硬切;悬疑氛围向可少量用 0.3 秒溶解 |
| 4 | Sora | 已于 2026-03 被 OpenAI 关停(A) | 被列为推荐工具(D、K) | 以素材 A 为准,D、K 工具清单已过时 |
| 5 | LoRA 训练图量 | 30-50 张(A) | 20-50 张(I) | 取 30-50 张更稳妥,图越多越稳 |
| 6 | LoRA 一致性 | 97%(A) | 0.90+(I 实测) | 97% 为理想值,0.90+ 为实测值,按 0.90 做预期管理 |
| 7 | 每镜时长 | 3-5 秒(H、C 部分场景) | 3-8 秒(C,30 秒短剧 6-8 场景) | 新手按 3-5 秒,节奏熟练后可在情绪镜头放宽到 6-8 秒 |
| 8 | 批量数 | 每镜 4-8 张备选(H) | batch_size=4 / 4-6 张(C、B) | 4-6 张起步;关键镜头放宽到 8 张 |
| 9 | CFG Scale | 7(B,SD 直出) | 7.5(C,ComfyUI)/ 提到 7-8 治抽搐(C) | 默认 7-7.5;动作抽搐时提到 7-8 |
附:素材来源完整清单
| 编号 | 标题 | 链接 |
|---|---|---|
| A | AI短剧教程:从零开始掌握人工智能短剧创作全流程 | https://www.tahou.com/article/214836021472535557 |
| B | AI 漫剧导演:用人工智能讲好每一个故事 | https://m.toutiao.com/article/7660392807806304787 |
| C | AI短剧制作:从脚本生成到画面渲染的全链路 | https://www.2ds.cn/?p=21002/ |
| D | 2025年风口项目:AI漫剧怎么做?这套”傻瓜式”教程请收好 | https://m.toutiao.com/article/7595061848358027830 |
| E | AI影视漫画怎么做的视频?AI工具帮你搞定剧本、角色、分镜、动态、后期全流程 | https://www.chooseai.net/news/1067/ |
| F | AI漫剧订单暴涨14倍,我拆解了普通人赚钱全流程 | https://www.toutiao.com/article/7682037576450032168 |
| G | AI短剧制作全流程——成本几百块,3天出一部 | https://www.toutiao.com/article/7668673383726449167 |
| H | AI漫剧制作全流程(长文,2026年) | 来源链接缺失(检索自公开内容平台) |
| I | 7种角色一致性方案 | 来源链接缺失(检索自公开内容平台,火星人教育公众号内容) |
| J | AI短剧·漫剧实战从0到1(系列) | 腾讯 ima 知识库收录,https://ima.qq.com/wiki/ (无精确文章链接) |
| K | 流程|4步做出一部AI短剧(拆解彭青云案例) | 腾讯 ima 知识库收录,https://ima.qq.com/wiki/ (无精确文章链接) |
声明:素材 H、I 无可用原文 URL,已如实标注;素材 J、K 为腾讯 ima 知识库收录,具体文章页 URL 不稳定,未编造精确链接。全文未编造任何 URL。

评论(0)