漫剧美术分镜Agent。独立使用场景:生成AI绘图Prompt、固化角色场景资产、解决角色变脸和画风割裂。 全流程场景:由 manju-workflow 自动调用,无需手动激活。 触发词包括:美术、绘图Prompt、角色设计、场景设计、AI绘图提示词、Midjourney、Stable Diffusion。
编程
manju-script-generator
试用漫剧工业化生产全流程工具 v5.1 — 三板分离法|七要素镜头语言|风格顾问系统|故事板图像生成|镜头控制模块库|去AI味提示词框架|工业级素材管理
它能做什么
漫剧工业化生产全流程工具 v5.1 — 三板分离法|七要素镜头语言|风格顾问系统|故事板图像生成|镜头控制模块库|去AI味提示词框架|工业级素材管理
技能文档
漫剧工业化生产全流程工具 v5.1 (Manju Script Generator)
概述
专业漫剧工业化生产流水线 v5.0 — 基于兄弟提供的实战漫剧工业化生产经验蒸馏 + 多平台深度研究整合
覆盖 剧本生成 → 角色形象设计 → 场景设计 → 道具提取 → 人物三视图 → 分镜脚本 → 七要素镜头语言 → 镜头控制模块库 → 去AI味提示词 → 图片/视频提示词 → 违禁词过滤 → 自检 完整链路。
v5.0 新增内容
| 新增功能 | 来源 | 说明 |
|---|---|---|
| Seedance 2.0全片段生成系统 | 15秒分镜.txt | 12-15秒自由时长片段化生成,完整片段标注模板,3-6个小镜头内部格式,切割点规则,连贯规则 |
| 仿真人分镜系统 | 仿真人分镜头提示词.txt | 10秒/15秒双版本,3秒决策原则,六维一致性准则,分镜生成四步法,违禁词过滤词典 |
| 3D真人提示词库 | 3D真人提示词.txt | 男性/女性角色提示词模板,要素组合表 |
| 3D角色道具提取系统 | 3D角色道具.txt | 全覆盖人物提取规则,3DCG国漫风格出图标准 |
| 场景纯净设计系统 | 场景.txt | 四大核心要素,两步流程,专业场景设定表模板 |
| 三视图提示词模板 | 三视图提示词.txt | 左侧三视图+右上六角度头像+右下四细节图布局 |
| 小说转剧本润色系统 | 小说转剧本.txt | 第一人称强制,开头黄金钩子规则 |
| 文案分幕旁白台词提取系统 | 文案分幕旁白台词提取.txt | 台词/旁白识别规则,情绪识别,JSON输出格式 |
| AI剧本生成与原创剧本 | AI剧本生成+AI原创剧本+改文指令 | 剧本生成指令,原创故事生成指令,改文指令 |
v4.0 核心升级(v5.0保留)
| 功能 | 说明 |
|---|---|
| 三板分离法 | 身份板+原图+故事板 核心方法论 |
| 剧本生成模式 | 爆款故事大纲+完整漫剧剧本 |
| 道具提取模式 | 全自动提取高频关键道具 |
| 人物三视图模式 | 3种提示词模板 |
| 风格库(80+) | 六大分类 |
| 国风打斗动作20式 | 突进/空中/防御/重击 |
| 提示词工程全体系 | 豆包AI绘图公式+14种摄影模块 |
| 视频提示词反向写作法 | 镜头控制>运镜逻辑>人物>动作>场景>风格 |
| 动词拆解法 | 一句剧情→圈出动词→每动词拆一镜 |
| 3D白模故事板5步法 | Midjourney→GPT Image→故事板→3D白模→Seedance |
| 场景俯瞰图空间锚定法 | 上帝视角标注位置/动线/视线 |
| 人物真实感公式 | 活人感角色图+嘴角/眼部/面部状态+肢体动作 |
| 过人脸三法 | 三视图→彩铅→九宫格 |
| 10秒/15秒双版本 | 分镜时间轴支持两种规格 |
| 十大避坑清单 | 常见错误案例对照 |
| 质量检查清单 | 8维质量检查项 |
核心能力
| 功能 | 说明 |
|---|---|
| 剧本生成 | 爆款故事大纲+完整漫剧剧本(镜号/画面/台词/音效/时长) |
| 角色形象提示词 | 全身像+纯白背景+写实电影感 |
| 场景图片提示词 | 无人纯场景,四大核心要素 |
| 道具提取 | 高频关键道具提取,白底写实电影感 |
| 人物三视图 | 3种提示词模板:角色设定板/三视图+特写+细节 |
| 分镜脚本 | 35-50字拆分,六维一致性,3秒决策原则 |
| 分镜→图片/视频提示词 | 逐段生成,角色映射,场景连贯,时间轴 |
| 七要素镜头语言 | 景别/角度/构图/光影/色调/动势/转场 完整指南 |
| 镜头控制模块库 | 7种基础运镜+组合+电影级术语 |
| 去AI味提示词框架 | 三大部分顺序敏感法 |
| AI视频提示词七要素公式 | 主体+动作+环境+运镜+光影+风格+声音 |
| 违禁词过滤 | 血腥/裸露/色情/封建迷信 自动替换 |
| 输出自检 | 6维校验 |
规则体系
- 内容镜头一致性原则: 35-50字以内分镜头拆分,单句文案完整
- 3秒决策原则: 人物齐全?场景连贯?违禁内容?→ 任一不满足中止重推
- 六维一致性准则: 人物/时空/物品/动作/台词/敏感过滤
- 分镜生成四步法: STEP1场景锚定→STEP2连续性检查→STEP3台词植入→STEP4敏感扫描
- 动词拆解法: 一句剧情→圈出动词→每动词拆一镜→每镜只做一个动作
- 高频错误避坑指南: 内置常见错误案例对照
快速上手
生成剧本(故事大纲+完整剧本)
python3 skills/manju-script-generator/generate.py --mode script --genre 仙侠虐恋 --output script.md
生成角色形象提示词
python3 skills/manju-script-generator/generate.py --mode character --input novel.txt --output character_prompts.md
生成场景提示词
python3 skills/manju-script-generator/generate.py --mode scene --input novel.txt --style 写实电影 --output scene_prompts.md
提取道具
python3 skills/manju-script-generator/generate.py --mode prop --input novel.txt --output props.md
生成人物三视图提示词
python3 skills/manju-script-generator/generate.py --mode threeview --input novel.txt --style 写实电影 --output threeview.md
生成分镜脚本(10秒版)
python3 skills/manju-script-generator/generate.py --mode storyboard --input novel.txt --characters characters.json --duration 10 --output storyboard.md
生成分镜脚本(15秒版)
python3 skills/manju-script-generator/generate.py --mode storyboard --input novel.txt --characters characters.json --duration 15 --output storyboard.md
全流程
python3 skills/manju-script-generator/generate.py --mode full --input novel.txt --characters characters.json --output full_output.md
全流程六步走
| 步骤 | 操作 | 输出 |
|---|---|---|
| 第一步:剧本生成 | 使用1-1/1-2指令,豆包或DeepSeek | 画面描述+台词+音效+镜头时长 |
| 第二步:人物形象 | 使用2-1指令,即梦/豆包模型5.0/4.5 | 角色全身像+三视图(16:9横屏) |
| 第三步:场景固定 | 使用2-2指令,即梦/豆包16:9横屏 | 场景图集 |
| 第四步:视频画面 | 使用3-1/3-2分镜指令,即梦模型2.0 | 视频素材(参考图法) |
| 第五步:配音 | TTS工具,旁白提取+情绪调节 | 配音音频 |
| 第六步:剪辑合成 | 剪辑软件合成 | 成品漫剧 |
分类
- 2D漫(漫画风)
- 3D漫(CG奇幻风)
- 仿真人漫(AI短剧)
过人脸限制三法(递进使用)
- 三视图法:直接用三视图当参考图
- 彩铅法:指令"帮我把这张图片变成彩铅风格的"
- 九宫格法:用美图秀秀在人脸叠加九宫格图片再上传
去水印方法
照片去水印: 豆包生成图片→点"变清晰(HD)"→选择提高清晰度小图→鼠标拖出桌面 视频去水印: 手机豆包App→分享→复制链接→微信小程序(水印斩/百灵鸟水印)→保存
三板分离法(核心方法论)
三板分离法是漫剧工业化的核心方法论,将角色、场景、动作三个维度分离管理,互不干扰。
2.1 身份板(Identity Board)
限定角色细节:五官/服装/姿态/表情矩阵
- 角色起始位置编号
- 活人感角色底图 + 真实皮肤质感
- 面部情绪 = 嘴角状态 + 眼部状态 + 面部状态
- 同一角色换场景 → 只改原图
- 同一场景换动作 → 只改故事板
- 动作不变换表情 → 只改身份板
2.2 原图(Reference Image)
限定风格场景:环境/光影/色调/氛围
- 场景俯瞰图作为空间锚定底图
- 场景环境 + 光源位置
- 发生原因 + 场景
- 同一角色换场景 → 只改原图
2.3 故事板(Storyboard)
限定景别运动:镜头语言/动作序列/时长
- 每个镜头标注位置编号 + 动线编号
- 表情细节 + 肢体动作 + 情绪语气 + 镜头构图
- 同一场景换动作 → 只改故事板
- 动作不变换表情 → 只改身份板
三板映射关系
身份板(角色) ←→ 原图(场景) ←→ 故事板(动作)
↓ ↓ ↓
角色一致性 场景一致性 动作连贯性
七要素镜头语言体系(v4.1新增)
源自火星时代《7个要素讲透AI短剧分镜》+ 多平台研究整合。每天超1300部AI短剧上线,差距不在模型,在分镜。
一、景别:决定观众看到多少信息
景别就是画面里装多少东西。装得多交代环境,装得少放大情绪。
| 景别 | 说明 | 使用场景 |
|---|---|---|
| 远景 | 角色极小甚至看不见,主打环境交代 | 开篇定场、剧情转折的氛围烘托 |
| 全景 | 角色完整出现,占画面1/3-1/2 | 角色出场、多人对话、动作戏开场 |
| 中景 | 截到膝盖以上,看清上半身动作和互动 | 日常对话的主力景别 |
| 近景 | 截到胸部以上,表情成为焦点 | 角色内心波动、关键铺垫 |
| 特写 | 只拍局部(脸/手/道具),环境几乎消失 | 情绪爆发点、关键线索展示 |
| 大特写 | 极致聚焦瞳孔、指尖、道具纹理 | 高潮戏情绪顶点 |
实操要点:一部短剧的景别要有变化节奏。冲突爆发前用中近景铺垫,爆发瞬间切特写冲击,高潮过后拉远景释放情绪。全程一个景别等于读PPT。
二、角度:决定观众站在什么位置看故事
换一个角度,同一个画面的情绪完全不同。
| 角度 | 效果 | 使用场景 |
|---|---|---|
| 平视 | 最接近人眼日常视角,客观真实有代入感 | 大部分日常场景首选 |
| 仰视 | 角色形象放大,传递威严/强大/压迫感 | 英雄出场、反派立威 |
| 俯视 | 角色被缩小,传递渺小/无助/孤独 | 陷入困境、被欺负 |
| 侧视 | 突出线条感和动作流畅度 | 行走、奔跑、内心独白 |
| 斜视(荷兰角) | 故意让画面歪着,制造混乱/紧张/眩晕 | 打斗、追逐、醉酒、精神异常 |
实操要点:角度要配合剧情情绪走。角色受辱时俯视压低,角色觉醒反击时仰视抬高,这个角度切换本身就是叙事。
三、构图:引导观众的视线落在哪
| 构图 | 说明 | 使用场景 |
|---|---|---|
| 三分法 | 横竖各分三份,核心元素放在交叉点 | 最通用最安全,日常场景闭眼用 |
| 对称构图 | 以中轴线左右或上下对称 | 稳定庄重感,婚礼殿堂/宫殿大门 |
| 引导线构图 | 用走廊/道路/栏杆等线条引导视线 | 追逐戏、场景过渡 |
| 框架构图(框中框) | 用门窗/树枝形成"画框" | 悬疑场景、角色被困、回忆片段 |
| 对比构图 | 通过大小/明暗/色彩对比突出核心 | 正邪同框、贫富差距 |
| 对角线构图 | 主体沿对角线分布 | 动作戏、动态场景 |
实操要点:选一种主构图写清楚就行。同时写"三分法+对称构图+引导线",AI会算力分散画面崩。
四、光影:画面情绪的画笔
光影是分镜里最容易被忽略但提升质感最明显的要素。
| 光影类型 | 效果 | 提示词写法 |
|---|---|---|
| 自然光(柔光) | 模拟日光月光,温暖真实 | 自然光(柔光),从左侧窗户射入 |
| 人造光(硬光) | 光线集中,阴影浓重,紧张神秘 | 人造光,顶光,阴影浓重 |
| 逆光(轮廓光) | 光源在角色后方,剪影/金色轮廓 | 逆光,夕阳为背景,金色轮廓 |
| 侧光(明暗分脸) | 一半亮一半暗,暗示内心矛盾 | 侧光,面部一半亮一半暗 |
| 低光影(暗调) | 整体偏暗,阴影占比极大 | 低光影,只留一束手电光 |
实操要点:每次写提示词养成"光影类型+光源方向"的习惯。不写光影的提示词,出图就像手机闪光灯直拍。
五、色调:确立整部作品的视觉基调
| 色调 | 效果 | 适用场景 |
|---|---|---|
| 暖色调(红/橙/黄) | 温暖/热情/治愈/紧张 | 甜宠剧、家庭剧、冲突高潮 |
| 冷色调(蓝/绿/青) | 冷静/压抑/神秘/孤独 | 悬疑剧、科幻剧、复仇剧 |
| 高饱和 | 色彩鲜艳明亮,活泼/梦幻 | 奇幻剧、喜剧、梦境 |
| 低饱和 | 色彩淡雅接近黑白,怀旧/伤感 | 文艺剧、悲剧、回忆片段 |
| 对比色调(冷暖并存) | 戏剧性最强,红与蓝冲撞 | 复仇剧、动作戏、正邪对抗 |
实操要点:单集只用一种主色调。系列剧可以用色调演变暗示剧情走向——前期冷调压抑,后期暖调治愈。
六、动势:让静态画面有流动感
动势解决的是"画面怎么动"的问题。
| 动势类型 | 效果 | 提示词写法 |
|---|---|---|
| 推镜头(由远及近) | 强化情绪冲击,聚焦重点 | 推镜头,缓慢靠近面部 |
| 拉镜头(由近及远) | 营造孤独感,交代全局 | 拉镜头,后拉至全景 |
| 摇镜头(左右/上下) | 展现宏大场景,强化纵深感 | 向左横摇90度 |
| 移镜头(平行移动) | 跟随角色动作,营造代入感 | 移镜头,平行跟随 |
| 跟镜头(全程跟随) | 代入感最强,接近第一视角 | 稳定跟拍,侧面跟随 |
| 静止镜头 | 稳定/严肃/压抑 | 固定镜头,中景固定 |
实操要点:写清"运动类型+运动速度"。"推镜头"不够,要写"推镜头,缓慢靠近"或"推镜头,快速逼近"。固定镜头占50%+,比全程花式运镜看着舒服。
七、转场:让镜头之间的切换不突兀
| 转场 | 效果 | 使用场景 |
|---|---|---|
| 硬切 | 直接切换,无过渡,最简洁最快 | 大部分日常切换和动作戏 |
| 淡入淡出 | 黑场或亮场过渡,温馨怀旧 | 回忆场景、时间跳转 |
| 叠化 | 两个画面重叠过渡,温柔流畅 | 思绪飘远、梦境切换 |
| 闪白 | 瞬间变白再切回,制造冲击感 | 晕倒、时间大跨度跳跃 |
| 匹配转场 | 利用形状/色彩/动作相似性衔接 | 苹果切到太阳、拳头切到门环 |
| 黑屏 | 全黑过渡,制造悬念 | 悬念结尾、新段落开始 |
实操要点:转场能简就简,硬切优先。同一条短剧里转场风格要统一。
镜头控制模块库(v4.1新增)
源自Seedance 2.0实战手册 + 阿里云开发者社区,涵盖7种基础运镜、组合运镜、电影级术语。
7种基础运镜
| 运镜 | 提示词 | 用途 |
|---|---|---|
| 推镜 | 缓慢推近 / 推至特写 | 强调细节、聚焦重点 |
| 拉镜 | 缓慢拉远 / 后拉至全景 | 揭示环境、收尾释放 |
| 横摇 | 向左横摇 / 右摇90度 | 展示空间 |
| 竖摇 | 镜头上移 / 下推 | 角色登场、空间揭示 |
| 环绕 | 轻微环绕 / 半圈环绕 | 立体展示主体 |
| 跟拍 | 稳定跟拍 / 侧面跟拍 | 沉浸感 |
| 固定机位 | 固定镜头 / 中景固定 | 对话、纪实风格 |
核心组合公式:推近 → 环绕 → 拉远(产品类/角色展示最稳)
进阶组合运镜
| 组合 | 效果 | 使用场景 |
|---|---|---|
| 推拉结合 | 先特写→再拉远 | 悬念揭示 |
| 跟拍+环绕 | 人物行走→镜头绕到正面 | 视角转换 |
| 升降+横摇 | 模拟航拍效果 | 宏大场景 |
| 手持晃动 | 轻微抖动增强临场感 | 追逐/打斗 |
| 主观视角(POV) | 第一人称沉浸 | 惊悚/动作 |
| 低角度仰拍 | 英雄感/气势感 | 角色觉醒 |
电影级专业运镜调用词
| 术语 | 效果 | 使用建议 |
|---|---|---|
| 希区柯克变焦(Dolly Zoom) | 制造空间扭曲感 | 关键反转瞬间 |
| 一镜到底 | 全程不切镜 | 追逐/探索场景 |
| 荷兰角 | 倾斜构图,不安氛围 | 悬疑/精神异常 |
| 升格慢动作 | 关键瞬间仪式感 | 高潮/情感爆发 |
| 匹配剪辑 | 视觉元素无缝转场 | 创意场景切换 |
| 螺旋环绕 | 能量爆发类场景 | 战斗/变身 |
使用建议:专业词不用多,一两个即可,过多会失控。
景别序列
常用叙事序列:
- 大远景→中景→特写:适合开场建立
- 特写→拉远至全景:适合揭示反转
- 中景→正反打特写→双人中景:适合对话场景
15秒分镜结构五种写法
| 结构 | 写法 |
|---|---|
| 时间轴法 | 0-3秒建立→4-8秒主体→9-12秒高潮→13-15秒定格 |
| 镜头编号法 | 镜头1→镜头2→镜头3 |
| 画面块法 | 画面1→画面2→画面3 |
| 三幕结构 | 铺垫→变化→收束 |
| 动作序列法 | A导致B→B触发C |
九宫格分镜法
- 用AI生成3x3九宫格分镜图,每格标注景别
- 强调角色一致性,格子之间必须有白色分隔线
- 核心提示词:
生成一张3行3列九宫格分镜图
[整体风格描述]
第1格:开场画面 ... 第9格:收尾
- 在Seedance中写:
参考@图片1九宫格
按从左到右从上到下顺序演绎
保持风格一致
运镜以缓慢推拉为主
去AI味提示词框架(v4.1新增)
源自Wayhhow/ai-video-shot-prompt-skill (GitHub) + Mx-Shell方法论。AI对提示词前段的注意力权重更高,顺序敏感。
三大部分框架(顺序敏感)
┌──────────────────────────────────────────────────────┐
│ 1. 【基础设定】 │
│ 时间 / 地点 / 人物 / 参考图描述 / 声音限制 │
├──────────────────────────────────────────────────────┤
│ 2. 【氛围画质】 │
│ 风格核心 / 去AI味 / 限制词 / 视觉基调 / 色彩影调 │
├──────────────────────────────────────────────────────┤
│ 3. 【画面内容】 │
│ 分镜 / 景别 / 构图 / 运镜 / 故事内容 │
│ (怎么做 → 为什么 → 效果) │
└──────────────────────────────────────────────────────┘
为什么这个顺序? 先锚人/地/时→再定调→最后讲故事。把"风格"和"限制词"放在中段,避免污染基础设定的字面理解。
去AI味关键词库
正向词:超写实、极致逼真、真人实景拍摄、电影动作捕捉、真实皮肤质感、自然光线、电影级布光
限制词:杜绝游戏CG感、杜绝动作僵硬、杜绝肢体扭曲、杜绝关节反向、杜绝镜头漂移、杜绝塑料感、杜绝磨皮感
视觉基调:ARRI Alexa 65拍摄、35mm镜头、RED Komodo、Sony Venice、胶片颗粒感
视频提示词对比示例
❌ 有AI味:一个美丽的女人在雨中行走,电影感 ✅ 去AI味:
【基础设定】雨夜,老旧居民楼楼下,积水反射路灯,25岁女性,短发,黑色风衣
【氛围画质】写实电影感,冷色调,弱光,轻微手持感,ARRI Alexa拍摄
【画面内容】中景缓慢推进,她握紧手机,犹豫两秒后快步走进楼道,压抑紧张
AI视频提示词七要素公式(v4.1新增)
源自Seedance 2.0博客《AI视频提示词写作指南》,适用于所有主流AI视频平台。
通用公式
[主体] + [动作] + [环境] + [运镜] + [光影] + [风格] + [声音]
七要素详解
| 要素 | 类型 | 必填 | 说明 |
|---|---|---|---|
| 主体(Subject) | 描述 | 是 | 谁在画面中?明确特征 |
| 动作(Action) | 描述 | 是 | 在做什么?用具体动词替代抽象 |
| 环境(Environment) | 描述 | 是 | 在哪里?时间/天气/地点/氛围 |
| 运镜(Camera) | 描述 | 推荐 | 镜头怎么动?推/拉/摇/移/跟/环绕 |
| 光影(Lighting) | 描述 | 推荐 | 光怎么打?光源方向+光线类型+明暗 |
| 风格(Style) | 描述 | 推荐 | 什么质感?电影/写实/动漫/古风 |
| 声音(Sound) | 描述 | 可选 | 什么声音?环境音/音效/BGM/对白 |
七要素组合示例
人像/情绪:雨中行走的女人
[主体]25岁短发女性,黑色风衣 [动作]在雨中快步行走,偶尔抬头看天
[环境]深夜城市街道,路灯昏黄,路面湿滑反射灯光 [运镜]中景,缓慢推进
[光影]顶光+侧光,冷色调 [风格]写实电影感,胶片颗粒 [声音]雨声+脚步声
动作场景:武术家出拳
[主体]古风武术家,白色练功服 [动作]快速出拳,衣袂翻飞,拳风凌厉
[环境]竹林深处,清晨薄雾 [运镜]低角度仰拍,快速推近
[光影]逆光,晨曦穿过竹林形成丁达尔光 [风格]邵氏武侠电影,高对比度
[声音]拳风破空声+竹叶沙沙声
平台专属提示词技巧
| 平台 | 技巧 |
|---|---|
| Seedance 2.0 | 结构化描述,时间轴分段,镜头编号 |
| 可灵Kling | 中文提示词,具体动作+场景,避免抽象 |
| Sora | 英文提示词,描述物理运动和因果关系 |
| Runway | 简洁描述,强调动作和运动 |
| 即梦 | 中文提示词+风格词,参考图法 |
工业级素材管理规范(v4.1新增)
源自腾讯云开发者社区《AI漫剧一条龙工业化制作流程》,解决规模化生产中的一致性难题。
核心原则
- 低场景:每部剧只保持3-5个核心场景,场景越少复用率越高
- 高素材复用:人物/场景/道具标准化生成,一次生成复用几十集
- 强情绪节奏:3秒爆点→10秒立角色→中段刺激→结尾反转
命名规范
# 人物命名
人物名_特征_状态
示例:林野_6岁、林野_17岁、数学老师_25岁
# 场景命名
场景名_特征_时间
示例:舅舅家客厅_白天、舅舅家客厅_夜晚、学校教室_白天
# 道具命名
道具名_状态
示例:酒杯_完整、酒杯_破碎、长剑_出鞘、长剑_归鞘
资产库建立流程
- 角色三视图:16:9横屏,纯白背景,正面/侧面/背面
- 空场景图:无人物,全景,环境完整
- 关键道具图:纯白背景,完整展示
分镜表字段规范
| 字段 | 说明 |
|---|---|
| 镜号 | 唯一编号 |
| 时间轴 | 该镜头在整集中的时间位置 |
| 时间 | 该镜头时长 |
| 场景 | 场景名+特征 |
| 人物 | 人物名+特征 |
| 道具 | 道具名+状态 |
| 剧本原文 | 对应的剧本内容 |
| 画面提示词 | AI生成用提示词 |
| 景别 | 远景/全景/中景/近景/特写/大特写 |
| 镜头运动 | 推/拉/摇/移/跟/固定 |
| 人物动作 | 具体可见动作 |
| 对白 | 台词内容 |
| BGM音效 | 背景音乐和音效 |
分镜表生成Prompt(工业版)
系统身份:你是一名拥有10年以上影视行业经验的AI漫剧分镜师,精通抖音和快手短视频节奏。
擅长制作:2-3分钟单集,强爽点/反转剧情,情绪外化型男频漫剧分镜。
任务:为AI漫剧《XX》第X集制作完整分镜表。
要求:
1. 单集总时长:2-3分钟
2. 单镜头时长:3秒-8秒,情绪爆点镜头3秒定格,定场全景不超过5秒
3. 景别限制:只使用大特写/特写/近景/中景/全景
4. 镜头运动:以切镜为主,只有情绪爆发和重大反转允许慢放
5. 分镜表字段:镜号/时间轴/时间/场景/人物/道具/剧本原文/画面提示词/景别/镜头运动/人物动作/对白/BGM音效/时长
6. 素材命名规范:人物_特征、场景_特征、道具_状态
7. 表达方式:画面必须视觉化,禁止抽象心理描写
8. 台词要求:单句不超过10字
9. 情绪节奏:开篇3秒情绪炸点,10秒内立住角色立场,结尾5秒悬念
节奏控制速查表(v4.1新增)
三档节奏模板
| 节奏 | 时间分配 | 适用场景 |
|---|---|---|
| 慢节奏 | 5秒铺垫 + 5秒主体 + 5秒收尾 | 治愈/文艺/情感剧 |
| 中节奏 | 3秒建立 + 7秒核心 + 5秒定格 | 日常/剧情/悬疑 |
| 快节奏 | 2秒起势 + 10秒密集 + 3秒爆发 | 动作/打斗/爽剧 |
情绪节奏公式
标准公式:开篇3秒爆点 → 10秒立角色 → 中段连续刺激 → 结尾5秒反转
每集结构:
- 3秒爆点:开场即高潮,抓住观众注意力
- 10秒立角色:让观众快速理解角色立场和关系
- 中段连续刺激:每20-30秒一个小高潮
- 结尾5秒反转:悬念导向下一集
镜头时长参考
| 镜头类型 | 建议时长 | 说明 |
|---|---|---|
| 定场全景 | 3-5秒 | 交代环境,不宜过长 |
| 对话 | 3-5秒 | 中近景,正反打 |
| 动作 | 2-4秒 | 快节奏,多角度 |
| 情绪特写 | 3-5秒 | 定格放慢 |
| 爆点冲击 | 2-3秒 | 快速切入,冲击力 |
| 悬念收尾 | 3-5秒 | 留白,过渡至下一集 |
工作模式
剧本生成模式 (--mode script)
输入: 小说类型 + 人设 + 故事大纲 输出: 故事大纲 + 完整漫剧剧本
剧本格式(每镜):
【镜号】【画面描述】+【台词/旁白】+【音效/背景音乐】+【单镜时长】
要求:
- 单集总时长60秒左右
- 开篇前3秒设置强看点
- 结尾设置悬念引导下一集
- 台词口语化,精简不啰嗦
20种小说类型: 同v3.0
角色形象提示词模式 (--mode character)
纯白背景 + 写实电影感 + 身高字段
- 人物衣服要精致,全身像,从头顶到脚尖完整构图,纯白背景
- 图片风格为写实电影感
场景提示词模式 (--mode scene)
同v3.0
道具提取模式 (--mode prop)
规则:
- 只提取反复多次出现、高频使用、关键剧情道具
- 剔除一次性临时杂物
- 道具信息:名称/外观造型/材质/颜色/尺寸/花纹/功能/特征
- 出图标准:纯白背景、写实电影感、高清质感、完整全景展示
人物三视图模式 (--mode threeview)
3种提示词模板:
- 角色设定板:左侧头部特写 + 右侧全身三视图,高级中性灰背景
- 16:9三视图:左侧1/3面部特写 + 右侧2/3三视图,白底
- 丰富版:正面/侧面/背面全身照 + 头部细节 + 服装配饰展示
即梦模型推荐: 图片模型4.7效果最佳
分镜脚本模式 (--mode storyboard)
时间轴10秒版:
[0-3秒] 镜头: [景别]+[镜头]+[核心动作]; 音效: [主音效]+[环境音]; [台词/画外音]
[3-6秒] 镜头: [景别]+[镜头]+[互动反应]; 音效: [关键音效]; [台词/画外音]
[6-8秒] 镜头: [景别]+[镜头]+[情绪特写]; 音效: [氛围音]; [画外音/沉默说明]
[8-10秒] 镜头: [景别]+[镜头]+[下一镜铺垫]; 音效: [过渡音]
时间轴15秒版:
[0-4秒] 镜头: [景别]+[镜头]+[核心动作]; 音效: [主音效]+[环境音]; [台词/画外音]
[4-8秒] 镜头: [景别]+[镜头]+[互动反应]; 音效: [关键音效]; [台词/画外音]
[8-12秒] 镜头: [景别]+[镜头]+[情绪特写]; 音效: [氛围音]; [画外音/沉默说明]
[12-15秒] 镜头: [景别]+[镜头]+[下一镜铺垫]; 音效: [过渡音]
新增要求: 在提示词前面加上"写实电影感风格,不要背景音乐。不要字幕"
全流程模式 (--mode full)
串联所有模式:剧本分析 → 角色形象 → 场景 → 道具 → 分镜 → 图片/视频提示词
风格库 v4.1扩充
4种基础风格指令
- 真人写实:超写实国风,写实风格,质感光照,8K高清纹理
- 2D动漫:纯正2D日系动漫插画,赛璐珞上色,美形人设
- 3DCG动漫:写真风格,逆水寒游戏风格,3D渲染技术
- Q版风格:大头小身,明亮配色,低细节高辨识度
130+风格库(六大分类)
国风类(25+): 邵氏武侠、胡金铨武侠、2D精致国漫、中国神话、3D国风高清、3D玄幻、水墨、工笔、皮影、上美风、敦煌壁画风、唐风仕女、宋韵山水、青绿山水、年画风、剪纸风、京剧脸谱风、仙侠厚涂、古风写实、国潮插画、新中式武侠、玄幻厚涂、古风赛璐璐、仙侠三渲二、水墨写意
日漫类(25+): 2D日式动画、吉卜力、鸟山明、藤本树、乔乔风、手冢治虫、大友克洋、三渲二、热血漫、暗黑漫画、新海诚、细田守、今敏、押井守、渡边信一郎、赛璐珞80年代、90年代少年漫画、少女漫画、萌系、机械机甲、和风妖怪、武士绘卷、怪谈、赛博朋克日漫、像素风日漫
美漫/西方类(15+): 2D西方漫画、3D美式、美漫动画、皮克斯迪士尼、黏土、定格、盲盒、积木、毛绒、手办、DC漫画、漫威漫画、辛普森风、卡通网络、成人动画
电影摄影类(30+): 复古港片、武侠、写实、90年代、战争、恐怖、悬疑、黑白、蓝橙色调、工业、科技感、赛博朋克电影、韩式冷淡、日式黑白胶片、中式暖调、王家卫风格、韦斯安德森、昆汀、诺兰、阿基多、雷德利斯科特、卡梅隆、斯皮尔伯格、大卫芬奇、温子仁、是枝裕和、是枝裕和、是枝裕和、张艺谋早期、侯孝贤、蔡明亮、是枝裕和
赛博/科幻/奇幻(20+): 赛博朋克、蒸汽朋克、废土、太空歌剧、暗黑哥特、3D球面、方块世界、概念艺术、达利、超现实、UE5写实、Y2K、厚涂、PBR、原子朋克、柴油朋克、生物朋克、纳米朋克、太阳朋克、钟表朋克、低多边形、数字雕刻、风格化渲染、光追写实
其他艺术(15+): 波普、魔法少女、羊毛毡、纸雕、水彩、孟菲斯、像素、蒸汽波、浮世绘、印象派、新艺术运动、装饰艺术、包豪斯、构成主义、超扁平
国风漫剧打斗动作20式
突进近身(5式)
- 瞬步突刺:残影拖曳,剑尖直指咽喉
- 踏空跃斩:空中翻转,自上而下劈砍
- 贴地滑行:低姿态突进,刀锋贴地扬起火花
- 瞬身换位:原地消失,出现在敌人身后
- 回旋踢击:单脚点地,身体旋转360°踢击
空中连击(5式)
- 凌空三连斩:空中连续三次斩击
- 倒挂金钩:倒挂姿态,双脚连环踢击
- 螺旋升天:旋转上升,带动气流形成漩涡
- 俯冲轰炸:高空俯冲,双拳砸地冲击波
- 空中转体:空中360°转体,剑气横扫
防御反制(5式)
- 格挡反击:横剑格挡,顺势反击
- 闪避反击:侧闪避开,反手一击
- 盾反震击:盾牌格挡,震退敌人
- 借力打力:借敌人攻击之力,反推回去
- 金钟罩:周身形成金色护罩,反弹攻击
重击气劲(5式)
- 霸王拳:双拳蓄力,轰出巨大拳影
- 剑气纵横:挥剑释放十字剑气
- 龙吟九霄:长啸一声,音波攻击
- 地裂山崩:双脚踏地,地面裂开
- 天罚降临:召唤天雷,劈向敌人
提示词工程全体系
豆包AI绘图高效指令公式
基础主体构建: [人物主体] + [表情细节] + [身体动作] + [情绪/语气] + [口型/台词意图] + [镜头/构图] + [光线] + [场景] + [风格/质量]
场景氛围营造: 环境描述(时间+天气+地点+氛围) / 光影控制(光源位置+光线类型+明暗对比) / 色调控制(冷暖+饱和度+明度) / 特殊效果(雾/雨/雪/粒子/光晕)
艺术风格融合: 渲染风格(真人写实/CG/3D动漫/2D动漫) / 世界观风格(赛博朋克/原子朋克/蒸汽朋克) / 导演风格(韦斯安德森/昆汀/宫崎骏)
特殊效果强化: 镜头语言(框中框/前景遮挡/广角畸变/多层景深/长焦压缩) / 构图法则(三分法/中心/对称/对角线) / 黄金点构图(左上/右上/左下/右下) / 布光方式(点光/顺光/逆光/伦勃朗光)
图生视频安全运动6式
万能模板: 为源图像制作动画:[具体运动方式],[保留细节要求]。镜头:[运镜指令]。灯光/氛围:[光影变化]。保持输出稳定。请勿更改[关键元素]。
6种经典导演镜头
通用公式: 导演风格 + 机位运镜 + 光影 + 色调 + 胶片质感 + 时间轴 + 情绪
混合媒介参数
核心公式: 【主体媒介】+【叠加媒介】+【匹配指令】+【碰撞关键词】 三板整合: 身份板=定角色媒介 / 原图=定背景媒介 / 故事板=定特效叠加媒介
视频提示词反向写作法
核心原理
AI注意力机制 = 权重优先级匹配,提示词越靠前影响力越强
正确顺序
镜头控制 > 运镜逻辑 > 人物主体 > 动作 > 场景环境 > 风格质感
实战公式
视频 = [镜头/运镜] + [人物动作] + [场景] + [风格]
人像 = [人物] + [真实皮肤细节] + [光线发丝] + [场景光效]
摄像机视角 = [相对镜头方向] + [动作] + [距离变化]
人物真实感公式
核心公式
AI真实感 = "活人感"角色图 + 嘴角状态 + 眼部状态 + 面部状态 + 肢体动作
面部情绪拆解
面部情绪 = 嘴角状态 + 眼部状态 + 面部状态
肢体动作原则
- 真实情绪不凭空出现,必须伴随肢体变化 + 发生原因
- 崩溃 = 双手猛抬捂脸 + 仰倒 + 双脚晃荡 + 身体扭动
违禁词过滤系统(同v3.0)
输出自检机制(同v3.0)
十五大避坑清单 v4.1扩充
| 序号 | 避坑项 | 正确做法 |
|---|---|---|
| 1 | 同景别硬切 | 景别交替(远/中/近/特写),避免连续同景别 |
| 2 | 一镜多动作 | 每镜只做一个动作,动词拆解法 |
| 3 | 忽略反应镜头 | 加入对手/环境反应镜头 |
| 4 | 运镜过度 | 固定镜头占50%+,推拉摇移适度 |
| 5 | 缺少定场 | 每段开头用大远景定场 |
| 6 | 人物脸崩 | 参考图+身份板+三视图保一致性 |
| 7 | 武器变形 | 道具单独设定+参考图 |
| 8 | 阵法不统一 | 能量色锁定+统一符号 |
| 9 | 节奏失控 | 3秒决策原则,慢/中/快节奏表 |
| 10 | 收尾天光缺失 | 每段结尾留情绪余韵 |
| 11 | 提示词太模糊 | 用具体可观察细节替换形容词,七要素公式 |
| 12 | 没有运动指令 | 每个视频提示词至少1个动词+1个运镜指令 |
| 13 | 矛盾指令(特写+远景) | 一个镜头只指定一种景别 |
| 14 | 缺少光影描述 | 每次写提示词养成"光影类型+光源方向"习惯 |
| 15 | 色调混乱 | 单集只用一种主色调,系列剧用色调演变暗示剧情 |
质量检查清单 v4.1扩充
- 人物一致性:同一角色在不同镜头中五官/服装/发型一致
- 场景一致性:同一场景在不同镜头中建筑/道具/光源方向一致
- 动作连贯性:镜头间动作衔接自然,无跳跃感
- 景别变化:避免同景别硬切,保持视觉节奏
- 色调统一:同一场景色调一致,转场有过渡
- 音频同步:音效与画面动作对齐,音乐情绪匹配
- 字幕规范:中文引号规范,无违禁词
- 时长控制:单镜头3-5秒,整体节奏紧凑
- 去AI味检查:检查是否有塑料感/游戏CG感/镜头漂移
- 光影合理性:光源方向一致,阴影位置合理
- 空间连贯性:角色位置/动线在镜头间逻辑一致
- 转场自然性:硬切为主,转场风格统一
核心规则
动词拆解法
一句剧情 → 圈出动词 → 每动词拆一镜 → 每镜只做一个动作 实战案例: "男主冲出山洞,拔剑,转身,爆气,击退敌人" → 拆为5镜
参数说明
| 参数 | 类型 | 必填 | 默认 | 说明 |
|---|---|---|---|---|
| --mode/-m | string | 否 | novel | 模式: script/novel/character/scene/prop/threeview/storyboard/full |
| --input/-i | string | 否 | - | 输入文件路径 |
| --output/-o | string | 否 | output.md | 输出文件路径 |
| --characters/-c | string | 否 | - | 角色配置JSON |
| --genre/-g | string | 否 | 仙侠虐恋 | 小说类型(1-20或名称) |
| --style/-s | string | 否 | 写实电影 | 视觉风格 |
| --duration/-d | int | 否 | 10 | 分镜时长: 10或15秒 |
| --with-three-view | flag | 否 | false | 生成三视图排版 |
| --forbidden-check | flag | 否 | true | 违禁词过滤 |
| --self-check | flag | 否 | true | 输出自检 |
TagoMovie平台配置
| 项目 | 内容 |
|---|---|
| 官网 | tagomovie.bitaihub.com |
| 注册 | 免费注册 + 算力按需充值 |
| 技术底座 | Seedance 2.0免排队 |
| 单集支持 | 3万字输入,AI自动拆解剧本 |
| 角色一致性 | 资产库保障 |
| 渲染 | 内置3D/2D动漫/写实风 |
| 智能模式 | 一周一部剧 |
| 行业承制 | 500~1000元/分钟 |
3D白模故事板5步法
- Midjourney → 跑人物+场景参考图
- GPT Image2 → 生成角色板(16:9艺术身份板)
- 生成故事板提示词(4列x3行16:9网格,黏土模型风格)
- Lib Image/Niji V6 → 生成3D白模故事板(16:9/2K/4K)
- Seedance 2.0 → 转视频(框选角色板+场景图+故事板)
场景俯瞰图空间锚定法
三步走:
- 画俯瞰图(上帝视角):标注建筑边界/核心道具/人物起始位置/光源方向
- 标注动线与视线:虚线箭头=人物移动路线,实线箭头=视线方向
- 按图索骥:每个分镜提示词包含"根据俯瞰位置图..."
元素
见 examples/input/ 和 examples/output/ 目录
本技能v4.1基于兄弟提供的AI漫剧工业化生产全流程SOP手册_v2.0 + 多平台深度研究整合 研究来源:B站/火星时代/腾讯云/阿里云/SegmentFault/GitHub(wayhhow)/Seedance 2.0博客/AniKuku/CineGen/LlamaGen/Renoise
情绪提示词系统(v5.0新增)
源自AI短剧制作大全(技镜教学),覆盖喜/怒/哀/惊四大类,100+细分情绪描述。
喜(开心、甜蜜、暗爽)
自然微笑:嘴角微微上扬,眼睛弯成月牙,脸颊有淡淡笑纹,眼神温柔 灿烂大笑:嘴巴张开露齿,眼睛眯成缝,眼角有笑纹,头微微后仰 暗爽得意:单边嘴角上扬,眼睛半眯,头微微偏侧,眼神带有一丝狡黠 羞涩低头:嘴角抿着微笑,眼神躲闪,脸颊泛红,头微微低垂
怒(愤怒、憋屈、爆发)
眉头紧锁:眉毛向下压成倒八字,眼神锋利,嘴唇抿紧,下巴微收 咬牙切齿:牙关紧咬,太阳穴青筋微凸,眼神凶狠,鼻翼微微扩张 爆发怒吼:嘴巴张大呈吼叫状,眉毛上扬,眼神瞪大,额头青筋暴起 冷眼相视:眼神冰冷,嘴角微抿,下巴微抬,面无表情但压迫感强
哀(悲伤、委屈、崩溃)
眼眶泛红:眼周泛红,泪水在眼眶打转,眼神失焦,嘴唇微颤 泪水滑落:一滴眼泪从眼角滑下,鼻尖泛红,眼神向下,嘴角微微下垂 崩溃大哭:双眼紧闭,泪水大量涌出,嘴巴张开哭喊状,表情扭曲 心死如灰:眼睛睁着却没有任何光芒,嘴角平直,面部肌肉完全松弛
惊(震惊、恐惧、害怕)
瞳孔放大:眼睛瞪大,瞳孔放大,嘴巴微微张开,身体僵住 瞳孔地震:眼睛瞪大,瞳孔剧烈收缩又放大,眉毛拧成一团 惊恐后退:眼睛瞪大,嘴巴张开,身体大幅后倾,一脚向后撤步 面如死灰:眼睛瞪大,脸上血色褪去,嘴唇发白发颤,额头渗出冷汗
完整情绪库见:modules/emotions.json
Seedance 2.0 15秒丝滑衔接四步法(v5.0新增)
第一招:首尾帧锁定过渡法
截取上一段视频最后一帧+下一段第一帧,用这两张关键帧单独生成5秒过渡短片。
第二招:动态镜头掩盖法
衔接节点提示词中加入大幅度动态镜头动作(极速推镜、人物大幅转身),利用视觉暂留掩盖瑕疵。
第三招:重叠帧叠化剪辑法
第一段0-15秒,第二段提前2秒重叠生成13-30秒,后期用叠化转场消除AI随机抖动。
第四招:提示词渐变过渡法
第二段提示词开头承接上一段结尾动作状态,避免动作突变。
提示词六步标准化写法(v5.0新增)
第一步:定基础参数(时长/比例/分辨率) 第二步:加画质稳定词(最高画质/五官稳定/不变形) 第三步:写主题+动作链(人物+外貌+2-3个连贯动作) 第四步:加场景+光线+氛围(地点+什么光+情绪) 第五步:加镜头+运镜(景别+运镜+构图) 第六步:加负面提示词(模糊/畸形/抖动/水印)
八大核心运镜手法(v5.0新增)
环绕镜:镜头围绕主体圆弧环绕,背景环形流动 跟镜:镜头跟随人物同步运动,叙事连贯 升镜:镜头垂直向上抬升,视野拓宽 推镜:镜头沿纵深向前推进,聚焦情绪 摇镜:镜头机位固定水平转动,展示环境 降镜:镜头垂直向下沉降,画面沉浸 拉镜:镜头匀速后退,疏离落幕 移镜:镜头与主体平行移动,动态氛围
仙侠法术提示词大全(v5.0新增)
御剑术:数十柄长剑悬浮半空,银白剑光交错 焚天术:双掌迸发赤红烈焰,火浪冲天,火龙盘旋 九霄雷法:紫蓝雷电汇聚,惊雷劈落,电弧炸裂 御水术:水流凝聚巨型水龙,水花飞溅 玄冰术:幽蓝寒光,冰霜蔓延,冰晶凝结 金光咒:金色神光迸发,护体光罩,符文浮现 星辰术:璀璨星团,银蓝星河,星盘环绕 空间术:空间撕裂,传送法阵,能量洪流 龙魂术:青龙虚影,青金流光,盘旋云层 剑阵术:百剑环绕,剑阵铺开,阵纹流转 完整法术库见:modules/spells.json
打斗动作提示词大全(v5.0新增)
极速瞬身突袭:身形虚化,多重残影,瞬间拉近距离 凌空飞踢:腾空跃起,身体舒展悬空,单腿猛踹 反手格挡防御:手臂横挡身前,侧身卸力稳住身形 蓄力重拳冲击:手臂向后蓄力,拳头紧握直击 落地震地重击:极速坠落,重击地面,碎石飞溅 完整动作库见:modules/combat.json
六大指令体系(v5.0新增)
- 角色设定类:人物形象+性格特征+服饰风格+表情
- 场景构建类:场景类型+时间天气+视觉细节+氛围
- 剧情分镜类:剧情节点+镜头类型+角色动作+台词
- 镜头运镜类:运镜方式+景别变化+运动轨迹+节奏
- 情绪氛围类:情绪关键词+色调光影+视觉元素+氛围
- 特效表现类:特效类型+能量形态+光影效果+冲击感
120个AI漫剧分镜指令大全(v5.0新增)
边境关隘:大远景,雪域雄关,烽火升起,骑兵阵列 古桥晨雾:远景,拂晓晨雾笼罩古桥,古装人物撑伞过桥 云端俯城:超远景,高空云海沉降,城池铺开,万家灯火 花海回廊:远景,繁花盛放,夕阳斜洒,人物独行廊下 雨夜屋顶:全景,古建屋顶被夜雨打湿,黑衣人踏檐疾行 眼底微光:眼部特写,瞳孔倒映火光,眼神从茫然变得坚定 泪痕未干:面部特写,干涸泪痕,新泪悬于眼眶 瞳孔收缩:眼部特写,兵刃逼近,瞳孔骤然收缩 侧脸逆光:近景,窗光勾勒侧脸,尘埃漂浮 横移揭示:镜头平稳横移,露出隐藏伏兵 骤停定格:镜头极速推进,在剑尖抵达前景时骤然定格 垂直坠落:镜头跟随人物从高空坠落,灯光快速掠过
爆款剧本拆解方法论(v5.0新增)
五步拆解法:拆3秒开局→拆全程节奏→拆冲突爽点→拆台词逻辑→拆结尾钩子 万能公式:低位开局受打压→逐级冲突升级→关键转折破局→阶段性爽点释放→结尾新危机悬念 单集模板:0-3秒钩子→15秒冲突→30秒反转→45秒爽点→结尾悬念
室内场景提示词大全(v5.0新增)
极简轻奢风:落地窗+白纱帘+高级灰+金属玻璃+无主灯柔光 温馨居家风:暖黄柔光+原木家具+布艺沙发+飘窗绿植 复古美式风:焦糖暖棕+皮质复古+木质厚重+落地灯 极简纯白风:全屋白灰+零杂物+悬浮家具+隐形灯带 复古港风:暖黄昏暗+胶片质感+老式吊扇+彩色玻璃灯 乡下居民风:实木旧家具+斑驳白灰墙+水泥地面+老式木窗 完整场景库见:modules/scenes.json
小说转剧本润色(v5.0新增)
源自小说转剧本.txt,适配漫剧短视频的专用润色系统。 核心规则:人称强制第一人称"我"叙事、内容精简、开头黄金钩子前3句、漫剧适配 执行流程:用户输入小说原文→直接输出润色后成品文本
文案分幕旁白台词提取(v5.0新增)
源自文案分幕旁白台词提取.txt,结构化JSON输出。 台词识别:提取带引号/破折号/感叹号等标记文本 旁白识别:非台词叙述性内容标记为"旁白" 情绪标注:为每条台词识别情绪和情绪强度 输出格式:[{"role_name":"角色名","text_content":"台词","emotion_name":"情绪"}]
场景纯净设计(v5.0新增)
源自场景.txt,电影级无人场景设计。 核心规则:画面无人+场景名四字以上+四大核心要素+Prompt以无人开头
3D角色道具提取系统(v5.0新增)
源自3D角色道具.txt,全自动解析小说人物角色+高频道具。 人物提取:全覆盖+基础信息+面部特征+穿搭细节+3DCG国漫风格出图 道具提取:高频关键道具+信息拆解+纯白背景出图
AI漫剧从零到一完整流程(v5.0新增)
工具:豆包(剧本)+即梦(角色/分镜)+可灵(图生视频)+剪映(剪辑配音) 六步:撰写剧本→拆解分镜→固定人设场景→批量生图→配音配乐→剪辑合成
模块化数据文件(v5.0新增)
modules/emotions.json:情绪提示词库 modules/lens.json:镜头类型库 modules/combat.json:打斗动作库 modules/spells.json:仙侠法术库 modules/character_prompts.json:3D角色提示词库 modules/scenes.json:场景提示词库
Seedance 2.0全片段生成系统(v5.0新增)
源自15秒分镜.txt,适用于即梦Seedance 2.0的CG国漫风格全片段生成系统,覆盖12-15秒自由时长片段化生成。
使用说明
每个片段独立生成,即梦无记忆,故所有字段必须完整写出,禁止简写。 每个非最后一个片段时长在12-15秒之间自由选择,最后一个片段按实际剩余时长(1-15秒任意)。 若整个场景总时长小于12秒,则仅生成一个片段,时长按实际秒数。 切割点必须选在动作的自然停顿处。同一场景内跨片段通过"接上一片段结尾"保持连贯;不同场景间通过渐隐渐显+字幕转场。
片段时长规则
- 非最后一个片段:时长在12秒、13秒、14秒或15秒中自由选择,以结束于动作自然停顿点为准
- 最后一个片段:按剧本实际剩余时长,1-15秒任意值,不强制凑满
- 若整个场景总时长小于12秒,则仅生成一个片段,时长按实际秒数
片段内镜头规则
- 每个片段内拆分成3-6个小镜头(推荐4-5个)
- 每个小镜头有明确的起止时间(如0-3秒、3-7秒...),所有镜头时长之和等于本片段时长
- 时间精度支持小数(如第3.5秒)
切割点规则(核心)
- 每个片段的结束点必须选在动作的自然停顿处
- 若剧本中无自然停顿,允许在切割点前插入0.5-1秒的"定格"镜头作为缓冲
- 备选方案:使用"重叠动作补偿"——在下一个片段开头重复上一片段结尾的最后1-2秒动作
片段顶部标注模板
【片段编号】 【片段时长】(秒数) 【场景名称】 【时间】(白天/夜晚/黄昏/凌晨等) 【内/外景】 【地点】 【人物】 【关键道具】 【垫图说明】 【负向提示词】模糊,变形,畸形手指,闪烁,色彩失真,口型不对,画面跳跃,低多边形,2D感,扁平,卡通渲染过重,低质量 【全局风格】CG国漫风格,三维渲染,国产动画电影质感,高精度模型,真实光影,4k,高细节
片段内小镜头格式
【镜头X】X秒 - X秒 画面描述:[景别] + [人物动作] + [表情] + [环境细节] + [光影色调] + [特效描述] 音效:[拟声词/环境音/动作音] 台词:第X秒时 角色名说:"台词内容" 口型同步,语气:[描述] 字幕:[如无则写"无"] 运镜:[运动方式] + [角度词](角度必填) 镜头结束状态:[精确描述本镜头最后一帧的视觉画面]
连贯规则
- 同一片段内镜头连贯:后一个镜头的画面描述开头必须自然承接前一个镜头的镜头结束状态
- 同一场景内跨片段连贯:下一个片段的第一个镜头画面描述必须以"接上一片段结尾,"开头
- 不同场景间切换:使用"渐隐渐显 + 字幕提示"
- 台词与口型:对白必含"口型同步",内心独白/画外音不写口型同步
- 回忆片段:画面转为暖黄色调,柔光,回忆质感
- 垫图一致性:同一场景内所有片段使用完全相同的参考图
- 负向提示词与全局风格:每个片段必须完整写出,禁止简写
仿真人分镜系统(v5.0新增)
源自仿真人分镜头提示词.txt,适用于仿真人/写实风格的10秒/15秒分镜生成系统。
内容镜头一致性原则
内容以35-50个字以内进行一次分镜头拆分,要求拆分出的单句文案内容要完整。
3秒决策原则
- 人物是否齐全?严格映射角色信息,未出现角色绝不写入
- 场景是否连贯?时间/地点/光线必须与上一镜一致
- 有无违禁内容?自动过滤血腥/低俗/政治敏感词
六维一致性准则
- 人物一致:出现角色必须严格匹配角色信息库
- 时空一致:相邻分镜时间、地点、光线必须无缝衔接
- 物品一致:关键道具位置状态需延续上一镜
- 动作连贯:新分镜起始动作必须承接上一镜结束状态
- 台词合规:仅当前说话角色有张嘴动作
- 敏感过滤:自动替换违禁词
分镜生成四步法
STEP1 场景锚定 -> STEP2 连续性检查 -> STEP3 台词植入 -> STEP4 敏感扫描
10秒版时间轴
[0-3秒] 镜头:[景别]+[镜头]+[核心动作];音效:[主音效]+[环境音];[台词/画外音] [3-6秒] 镜头:[景别]+[镜头]+[互动反应];音效:[关键音效];[台词/画外音] [6-8秒] 镜头:[景别]+[镜头]+[情绪特写];音效:[氛围音];[画外音/沉默说明] [8-10秒] 镜头:[景别]+[镜头]+[下一镜铺垫];音效:[过渡音]
15秒版时间轴
[0-4秒] 镜头:[景别]+[镜头]+[核心动作];音效:[主音效]+[环境音];[台词/画外音] [4-8秒] 镜头:[景别]+[镜头]+[互动反应];音效:[关键音效];[台词/画外音] [8-12秒] 镜头:[景别]+[镜头]+[情绪特写];音效:[氛围音];[画外音/沉默说明] [12-15秒] 镜头:[景别]+[镜头]+[下一镜铺垫];音效:[过渡音]
违禁词过滤词典
血腥暴力类:血液飞溅、喷血、鲜血淋漓、血池、血祭、分尸、碎尸、斩首、砍头、挖眼、掏心、剥皮、凌迟、虐杀、酷刑、断肢、爆头、穿刺、撕咬、屠杀、灭门、焚尸、尸横遍野、血肉模糊
裸露低俗类:全裸、半裸、袒胸露背、露私密部位、一丝不挂、裸体、性感暴露、挑逗性裸露
色情与性暗示类:色情、淫秽、嫖娼、卖淫、性交易、一夜情、通奸、乱伦、约炮、撩骚、艳舞、脱衣舞
封建迷信类:血腥祭祀、活人献祭、血咒、尸变、僵尸吸血
危害公序良俗:自残、自杀、暴力教唆、聚众斗殴、黑帮火拼、恐怖袭击、校园暴力
输出格式
有子文案拆分使用分镜头X-X编号,无子文案拆分使用分镜头X编号,每个分镜头包含原文案、时间轴镜头、场景描述。
3D真人提示词库(v5.0新增)
源自3D真人提示词.txt,适用于即梦/豆包等AI绘图平台的3D真人风格角色提示词模板。
男性角色提示词模板
通用模板: 真人写实风格,极繁主义风格,古风,美男,动态光影,冷峻,强对比度,暗黑风,氛围感,极致细节,冷白皮,面部特写,面部聚焦,面容精致,皮肤细腻,轮廓分明,细致描绘,发丝根根分明,面容细腻渲染,发丝细腻渲染,皮肤细腻渲染,五官立体,极致超清,极致细节
要素组合表:
| 要素 | 可选值 |
|---|---|
| 风格 | 真人写实/CG建模/3D动漫厚涂/精细三维渲染/3D古风 |
| 气质 | 俊美/妖冶/邪魅/清冷/冷峻/疯批/阴湿/温柔/高贵 |
| 面部 | 丹凤眼/单凤眼/狭长双眼/面部特写/半身像/全身像 |
| 发型 | 及腰长发/灰色长发/白发/黑发/披散/束发/凌乱拂面 |
| 服饰 | 黑色刺绣丝绸/古风薄纱/西装/汉服/银白色服饰/魔皇长袍 |
| 光影 | 动态光影/逆光/侧光/明暗对比/光影斑驳/唯美光影 |
| 背景 | 黑夜花园/古色古香/魔殿/桃花林/黑色背景 |
女性角色提示词模板
通用模板: 三维古风,3D仿真,特写,精致刻画,流畅的线条,梦幻感,绝色美女,倾国倾城,柔光,梦幻光影,色彩弥漫,极简风格,古风女子,华丽的发冠,黑发,4K,全身视角,半身视角
要素组合表:
| 要素 | 可选值 |
|---|---|
| 风格 | 新三维古风/3D仿真/三维古风/板绘插画/CG建模/数字艺术/厚涂插画 |
| 气质 | 妖冶美丽/清冷/孤寂/矜贵清冷/破碎感/神秘/冷漠 |
| 面部 | 凤眼/面容精致/五官立体/冷白皮肤/面部轮廓柔和 |
| 发型 | 黑灰色及腰蓬松长发/银色长发/黑发/半扎/自然垂落/碎发被风掀起 |
| 服饰 | 半透轻纱裙摆/镂空银丝图案/黑白色披风连衣帽/小香风/华丽发冠 |
| 光影 | 柔和光芒/柔光/暗夜微光/光线柔和/专业打光 |
| 背景 | 黑色背景/留白/幻境/雪景 |
3D角色道具提取系统(v5.0细化)
源自3D角色道具.txt,全自动解析小说人物角色+高频道具的专用提取系统。
核心设定
专业漫剧短视频创作专属解析提取智能体,接收用户输入的小说/故事全文,全自动精准拆解,完整提取所有出场人物角色+高频重复道具。
人物角色提取规则
- 全覆盖提取:统计文章内所有出现的有名、无名关键人物、配角、反派、龙套,无遗漏
- 信息完整拆解:基础信息(名称/性别/年龄/身高)、面部特征(脸型/五官/发型/发色/妆容)、身形体态(体型/比例)、穿搭细节(从头到脚完整描写)
- 画面出图标准:正面站立全身完整镜头,纯白色背景,3DCG国漫风格,影视级高精度建模,PBR光照,自然直立站姿
道具提取规则
只提取反复多次出现、高频使用、关键剧情道具、专属标志性物品,剔除一次性临时杂物。信息包含:道具名称、外观造型、材质、颜色、尺寸、花纹细节、功能作用、独有特征。出图标准:纯白背景、3DCG国漫风格。
输出格式
内容分区排版,分为【全文全部角色档案】【高频关键道具清单】两大板块。每个角色独立分段,附带对应3DCG国漫风格纯白背景全身立绘通用绘图提示词。
场景纯净设计系统(v5.0细化)
源自场景.txt,电影级无人场景设计系统。
核心执行逻辑
- 绝对真空与匿名:画面中严禁出现任何人影,场景描述文字中严禁出现任何角色人名
- 场景命名法则:每个场景名称必须在四个字以上,通过具体的修饰词增加辨识度
- 四大核心要素:[环境类型]、[具体时间]、[空间氛围]、[视觉主要特征]
- Prompt开头:所有Prompt必须以"不能出现其他人,无人纯场景,"开头
- 输出控制:严禁输出任何括号内的说明文字,直接输出具体内容
执行流程
第一步:场景提取清单(按顺序编号列出地点/核心氛围/建议色调) 第二步:专业场景设定表(场景名称/画幅构图/视觉风格/场景描述/Prompt)
专业场景设定表模板
**场景名称**:[四个字以上的独特命名] **画幅构图**:横向16:9电影级场景设定图,极高画质,纯净无人的空间。写实电影风格 *视觉风格*:[填入用户指定风格],极致细节 **场景描述**:[地理/建筑空间属性][时间时刻][空间氛围][主要特征] **Prompt(直接复制)**:不能出现其他人,无人,纯场景,[融合所有环境细节的描述词,包含:no humans, empty, landscape only]
三视图提示词模板(v5.0细化)
源自三视图提示词.txt,适用于即梦/豆包等AI绘图平台的人物三视图角色设定板。
完整模板
一张高精度、干净极简的角色设定板/人物三视图参考页,纯白背景,整体像游戏角色建模设定图。 画面左侧为人物全身三视图(正面/左侧面/背面),三个人物必须是同一个角色,五官、发型、服装、体型、身高比例完全一致。 画面右侧分为上下两个板块:右上区域放置六张人物头像/头部视角图(正面/低头俯视/后脑勺/左侧脸/正侧脸对照/3/4侧脸),右下区域放置四张人物局部细节图(上衣面料/下身正面/眼部五官/鞋子单品)。 整体风格要求:极简、专业、写实、统一、干净、高级。 输出要求:横版构图,白底,完整人物,不裁切,不出现多余道具、文字说明、LOGO、水印、UI元素。
小说转剧本润色系统(v5.0细化)
源自小说转剧本.txt,专为漫剧短视频创作者服务的小说润色系统。
核心润色规则
- 人称强制:全文统一使用第一人称"我"叙事,绝对不切换第三人称
- 内容精简:彻底删除所有废话、冗余描写、无关铺垫、重复语句,只保留推动剧情、塑造情绪、制造冲突的核心内容
- 开头黄金钩子:开头前3句话必须设置强悬念、抛钩子,直接制造好奇点,禁止平淡开篇
- 平台合规:严格遵守所有短视频平台内容规范
- 漫剧适配:润色后文本画面感极强,方便后续转化为漫剧分镜、台词
执行流程
用户输入任意小说原文后,直接输出润色后的成品文本,不提问、不解释、不额外沟通。
文案分幕旁白台词提取系统(v5.0细化)
源自文案分幕旁白台词提取.txt,将小说内容自动划分为角色台词和旁白,输出结构化JSON。
台词识别规则
- 必须完整保留原文内容,不得遗漏、删改或省略任何字句
- 提取角色对话内容和旁白,识别所有带引号、破折号、感叹号、冒号等常见台词标记的文本
- 相邻台词如属同一角色,可合并为一条,但单条台词长度不得超过50字
- 若单条台词超过50字,需按语义完整性拆分为多条
旁白识别规则
- 所有非台词的叙述性内容均标记为"旁白"
- 必须保留原文的所有文字内容
- 相邻旁白可合并为一条,单条长度35-55字
- 若单条旁白超过230字,需按语义完整性拆分
情绪识别规则
根据上下文为每条台词识别情绪和情绪强度,旁白统一为:情绪"平静",强度"中等"。
输出格式
json [ {"role_name": "角色名/旁白", "text_content": "内容", "emotion_name": "情绪", "strength_name": "强度"}, ... ]
AI剧本生成与原创剧本(v5.0新增)
源自AI剧本生成.txt和AI原创剧本.txt,提供AI剧本生成和原创故事生成的完整指令。
剧本生成指令
你是专业的漫剧剧本编剧,基于人设和故事大纲,生成第X集700字的故事。要求:开篇强看点,文案适合AI生成漫剧画面,台词口语化,结尾设置悬念。
原创故事生成指令
角色设定为故事编辑大师,编写关于指定题材的故事。要求:开篇强烈冲突与悬念,剧情反转密集,爽点频繁,每一集设计钩子,规避版权问题,遵守平台内容审核红线。
改文指令(二次改编)
改编原小说为自媒体平台推广文案,要求:开头反转霸气,内容跌宕起伏,结尾设置悬念,适配漫剧可视化呈现。
风格顾问系统(v5.1新增)
源自风格顾问提示词模板.md,专业电影级视觉风格顾问系统,用于确定短片、广告片、品牌片、剧情片或概念片的整体视觉风格。
核心流程
- 用户提供明确风格描述 → 直接整理强化成高级、电影感、可执行的风格文字
- 用户描述不完整 → 用不超过5个问题引导确认风格
- 用户说"不确定" → 提供3个风格方向供选择
- 最终只输出【整体风格设定】文字,不输出分镜、不输出镜头表、不输出技术参数
风格确认要素
| 要素 | 说明 |
|---|---|
| 影片类型 | 品牌广告/人物短片/产品大片/剧情短片/概念视觉片/音乐视觉片 |
| 核心气质 | 高级/梦幻/冷峻/温暖/神秘/未来感/复古/自然/暗黑/诗意/纪实 |
| 视觉参考 | 高定时装大片/奢侈品广告/电影感剧情片/科技发布片/艺术影像/胶片摄影 |
| 光影语言 | 体积光/逆光/柔光/硬光/霓虹光/烛光/自然光/舞台光/低照度光影 |
| 色彩倾向 | 冷调银蓝/暖金琥珀/黑金/高饱和/低饱和/复古胶片色/柔和粉彩/极简黑白 |
| 质感细节 | 丝绸/金属/玻璃/皮革/水雾/肌肤/珠宝/织物/建筑表面/自然纹理 |
| 画面语言 | 浅景深/梦幻光斑/动感模糊/超写实细节/胶片颗粒/慢速优雅/强对比构图 |
方向引导提问模板
为了确定影片整体风格,我先帮你锁定几个方向:
1. 你希望这支影片更接近哪种气质?
A. 高定奢华、梦幻、精致
B. 冷峻未来、科技、极简
C. 温暖自然、诗意、治愈
D. 暗黑神秘、戏剧化、强光影
E. 复古胶片、怀旧、艺术感
2. 影片主体是什么?例如人物、产品、空间、城市、自然景观或某个品牌概念。
3. 你希望观众看完后的第一感受是什么?例如高级、震撼、心动、安静、神秘、昂贵、浪漫、先锋。
输出格式
【整体风格设定】
一段极具[核心气质]与[审美等级]的[影片时长/影片类型]视觉大片。
画面强调[核心视觉元素1]、[核心视觉元素2]、[核心视觉元素3]以及[材质/细节表现]。
整体影像呈现[光影特点]、[色彩倾向]与[镜头质感],
兼具[情绪关键词]和[品牌/叙事气质],
营造出[最终观感]的电影级视觉体验。
示例输出
【整体风格设定】
一段极具电影感与高级质感的30秒高定品牌级视觉大片。
画面强调梦幻光斑、丝滑的动感模糊转场、体积光以及超写实的材质细节表现力。
整体影像呈现柔和而奢华的光影层次、冷暖交织的高级色彩与浅景深镜头质感,
兼具神秘、优雅与精致的品牌气质,
营造出如奢侈品广告般梦幻、昂贵、令人沉浸的视觉体验。
故事板图像生成系统(v5.1新增)
源自故事板提示词(1).txt和草图故事板提示词.txt,专业电影制作板/视觉规划表生成系统,用于生成可直接用于AI视频生成的16:9故事板图片。
故事板图片结构
┌─────────────────────────────────────────────────────┐
│ 共享创意指导(顶部栏) │
│ 镜头数量 / 统一调色板 / 环境背景 │
├─────────────────────────────────────────────────────┤
│ 角色与风格参考 │ 环境和场景设计 │
│ 多角度模型 │ 户外地点 + 俯视示意图 │
│ 正面/背面/侧面/特写 │ 摄像机位置 + 拍摄类型 │
│ 服装配饰参考 │ 移动路径标注 │
├─────────────────────────────────────────────────────┤
│ 故事板区域(6个编号帧) │
│ 帧1 帧2 帧3 │
│ [景别/运镜] [景别/运镜] [景别/运镜] │
├─────────────────────────────────────────────────────┤
│ 帧4 帧5 帧6 │
│ [景别/运镜] [景别/运镜] [景别/运镜] │
├─────────────────────────────────────────────────────┤
│ 灯光/情绪/风格备注 │ 情绪关键词块 │ 音频/音调 │
│ 照明条件/氛围/纹理 │ 情绪基调列表 │ 环境音/音乐 │
├─────────────────────────────────────────────────────┤
│ 电影摄影笔记 │
│ 镜头特性/运动风格/后期处理感觉 │
└─────────────────────────────────────────────────────┘
单镜头面板结构
每个镜头面板包含以下要素:
顶部信息栏
- 镜头编号 (Shot No.):如01, 02, 03
- 景别 (Shot Size):远景WS/全景FS/中景MS/近景CU/特写CU/大特写ECU
- 机位角度 (Camera Angle):平视/俯拍/仰拍/侧拍/背拍/过肩/主观视角
- 运镜 (Camera Movement):固定/推/拉/摇/移/跟/环绕/手持
分镜草图区
- 大面积草图展示区,面积大于文字区
- 黑白分镜,线条简洁
- 人物/物体运动用红色箭头表示
色卡区
- 全局信息区下方或侧边放置一排可视化色块
- 每页建议4-6个色块
- 色块必须可视化呈现,不要只写文字
箭头图例
- 红色实线箭头:人物/物体运动方向
故事板生成提示词
按照@图片1故事板的要求生成视频,不要出现BGM,不要出现字幕
草图故事板生成指令
你的任务是根据用户提供的文字信息、参考图等资料,直接生成一张"故事板图片"。
严格按照以下内容生成对应数量分镜和内容的故事板:
具体内容:
[用户提供的剧本/分镜内容]
全局信息区 (Global Header)
位于故事板图片顶部,用于说明整页通用信息。保持简洁,不要写长段说明。
色卡区 (Color Palette)
在全局信息区下方或侧边放置一排可视化色块,用于统一本段视频相关的画质颜色。
- 每页建议4-6个色块
- 色块必须可视化呈现,不要只写文字
↗ 箭头图例区 (Arrow Legend)
- 红色实线箭头:人物/物体运动方向
??? 单个镜头面板结构 (Shot Panel)
每个镜头面板以"分镜草图"为主体,文字信息只保留草图不容易准确表达的镜头控制项。
【顶部信息栏】
镜头编号 (Shot No.):[如:01]
景别 (Shot Size):[远景WS/全景FS/中景MS/近景CU/特写CU/大特写ECU]
机位角度 (Camera Angle):[平视/俯拍/仰拍/侧拍/背拍/过肩/主观视角]
运镜 (Camera Movement):[固定/推/拉/摇/移/跟/环绕/手持]
【分镜草图区】
[大面积草图展示区]
- 草图是每个镜头面板的主要内容,面积要大于文字区
- 草图是黑白分镜,线条简洁
- 如果有人物或物体运动,必须用红色箭头表示
视频生成时引用
按照@图片1故事板的要求生成视频,不要出现BGM,不要出现字幕
更新日志
v5.1.0 (2026-07-24)
- 新增Seedance 2.0全片段生成系统:12-15秒自由时长片段化生成,完整片段标注模板,3-6个小镜头内部格式,切割点规则,连贯规则
- 新增仿真人分镜系统:10秒/15秒双版本,3秒决策原则,六维一致性准则,分镜生成四步法,违禁词过滤词典
- 新增3D真人提示词库:男性/女性角色提示词模板,要素组合表
- 细化3D角色道具提取系统:全覆盖人物提取规则,3DCG国漫风格出图标准
- 细化场景纯净设计系统:四大核心要素,两步流程,专业场景设定表模板
- 细化三视图提示词模板:左侧三视图+右上六角度头像+右下四细节图布局
- 细化小说转剧本润色系统:第一人称强制,开头黄金钩子规则
- 细化文案分幕旁白台词提取系统:台词/旁白识别规则,情绪识别,JSON输出格式
- 新增AI剧本生成与原创剧本指令:剧本生成指令,原创故事生成指令,改文指令
- 所有新内容源自兄弟桌面文件夹《新建文件夹 (2)》实战素材
相关技能
漫剧编剧分镜Agent。独立使用场景:单独编写标准化分镜表、拆解故事为分镜脚本。 全流程场景:由 manju-workflow 自动调用,无需手动激活。 触发词包括:写分镜、编剧、分镜表、分镜脚本、镜头拆解、帮我出分镜。
漫剧剪辑合成Agent。独立使用场景:输出配音方案、剪辑执行清单、字幕BGM配置、导出参数。 全流程场景:由 manju-workflow 自动调用,无需手动激活。 触发词包括:剪辑、后期、合成、配音、字幕、BGM、剪映、导出。
漫剧制作全流程自动串联引擎。当用户提出漫剧创作需求时,自动按流程依次执行 总控定调→编剧分镜→总控校验→美术绘图→动态动画→剪辑合成,全程自动流转, 无需用户手动切换Agent。触发词包括:制作漫剧、全流程、开始创作、做一集漫剧、 漫剧工作流、启动漫剧制作、帮我做漫剧。
将AI漫剧链接转化为完整故事和AI分镜脚本。当用户提供漫剧链接并希望生成故事、脚本、分镜;或用户提到"漫剧二创"、"漫剧链接生成故事"、"AI漫剧脚本"、"看到一部漫剧想改编"等需求时使用此技能。
漫剧动态动画Agent。独立使用场景:将静态分镜转为动态视频Prompt、控制运镜和动态细节。 全流程场景:由 manju-workflow 自动调用,无需手动激活。 触发词包括:动态、动画、图生视频、可灵Kling、Pika、Runway、让画面动起来。