first commit

This commit is contained in:
2026-05-17 17:04:23 +08:00
commit 823b349023
155 changed files with 8553 additions and 0 deletions
@@ -0,0 +1,118 @@
# API 体系输出规则
## 目标
把每个分镜片段从“给人看的提示词”升级为“可交给程序调用的请求规格”。
每个视频片段必须输出:
1. 资产映射:内部引用 → 文件路径/URL/asset URI。
2. 官网提示词:适合在网页端 @ 已上传图片。
3. API 提示词:适合在请求体中引用图片输入。
4. API 请求体草案:JSON 或 JSONL。
5. 任务参数:模型、时长、分辨率、比例、回调地址占位。
## 火山方舟/Seedance 官方能力要点
根据火山方舟官方文档:
- 视频生成 API 是异步任务,通常需要先创建任务,再查询结果或接收回调。
- 输入 `content` 支持文本、图片等信息;公开模型能力强调音频、视频、图片、文本均可作为参考。
- 可信素材/真人素材可使用 `asset://<asset_id>` URI,并在 `content` 中以 `role: "reference_image"` 传入。
- 真人素材入库有格式和一致性校验要求,建议正面清晰图。
- 单条任务的文本提示词要写明参考职责,例如“参考图1锁定角色外貌,不参考图中背景;参考图2锁定场景空间”。
- 如果平台或接口支持首帧、尾帧、返回最后一帧或视频延展,连续短剧优先用上一段尾帧作为下一段首帧参考。
参考:
- `https://www.volcengine.com/docs/82379/1520757`
- `https://www.volcengine.com/docs/82379/2315856`
- `https://www.volcengine.com/docs/6492/2165104`
## 资产 URI 类型
| 类型 | 示例 | 适用 |
| --- | --- | --- |
| 公网 URL | `https://cdn.example.com/jiang-shangli.png` | 普通参考图 |
| 火山资产 | `asset://asset-20260222234430-mxpgh` | 可信素材库/真人素材/虚拟人像 |
| 本地文件 | `assets/characters/jiang.png` | 仅用于清单,不可直接提交 API |
本地文件必须先上传到对象存储、CDN、火山素材库或 Files API,变成 URL/asset URI 后才能进入视频 API。
## 官网 @ 上传图片写法
如果官网支持对已上传图片直接 `@`,提示词应该写成:
```text
@姜尚离_百姓装 @霍念_粗布农夫 @伯府狗洞_泥地
自然克制的真实演员表演。姜尚离从狗洞外泥地站起,先低头看自己沾泥的指节,停半秒,再看向霍念……
```
要求:
- 输出“官网上传名”,也就是用户上传图片后在官网里给图片/素材起的名字。
- `@` 后的名字要和官网素材名一致,不要只使用内部引用。
- 同一角色跨片段使用同一个上传名。
## API content 草案
火山方舟文档中的素材引用形态类似:
```json
{
"type": "image_url",
"image_url": {
"url": "asset://asset-20260222234430-mxpgh"
},
"role": "reference_image"
}
```
建议每个片段生成如下草案。具体字段以你账号控制台文档为准:
```json
{
"model": "doubao-seedance-2-0-pro",
"content": [
{
"type": "text",
"text": "参考图1锁定姜尚离外貌、发型和服装,不参考图中背景;参考图2锁定霍念外貌和服装;参考图3锁定伯府狗洞场景空间、泥地材质和冷天光。中景,姜尚离从狗洞外泥地站起,12s,9:16,电影级写实。首帧……镜头……时间节拍:0-3s 动作;3-7s 姜尚离低声说“我自己来”;7-12s 霍念听见后停半秒。对白/口型/表演:Seedance 生成姜尚离同期对白“我自己来”,声音很低,语速慢,口型自然,霍念无对白。声音:屋外轻微风声,木桌轻响,无VO,无背景音乐。尾帧……约束:不要字幕,不要把对白文字显示在画面里,不要水印,不要变脸,不要新增人物,不要多余旁白。"
},
{
"type": "image_url",
"image_url": {
"url": "asset://asset-xxxx-jiang-shangli"
},
"role": "reference_image"
},
{
"type": "image_url",
"image_url": {
"url": "asset://asset-xxxx-huo-nian"
},
"role": "reference_image"
}
],
"parameters": {
"duration": 12,
"resolution": "720p",
"aspect_ratio": "9:16",
"return_last_frame": true
},
"callback_url": "https://your-domain.com/seedance/callback"
}
```
`return_last_frame` 只是连续性占位字段,只有账号实际接口支持时才保留;如果接口字段名不同,按控制台文档替换。
## 输出文件
每集新增两个文件:
- `09_official_site_prompts.md`:官网 @ 上传图片版提示词。
- `10_api_payloads.jsonl`:每行一个视频生成任务 JSON 草案。
全剧新增:
- `09_api_asset_manifest.md`:所有资产的文件名、URL、asset URI、官网上传名。
- 如需批量执行计划,可另行输出 `10_api_batch_plan.md` 或放入项目级执行文档;不得占用分集 `10_api_payloads.jsonl` 命名。
@@ -0,0 +1,79 @@
# 附件引用与 @ 标签规则
## 核心结论
`@角色名``@场景名``@道具名` 是本工作流内部的资产引用名,不等于平台已经拿到了图片。
在即梦官网、Seedance Web 或其他网页端:
- 必须手动上传图片/视频/音频附件。
- 提示词只能描述这些附件的用途,例如“参考已上传的角色图1作为姜尚离外貌”。
- 不要指望在纯文本里写 `@姜尚离` 就自动附带图片。
在 API 里:
- 先上传图片或提供公网可访问 URL。
- 请求体里传 `image_urls``content` 或类似字段。
- 提示词里用平台规定的标签引用,例如 `@Image1``@Image2`
## Web 官网手动上传写法
每条视频提示词前输出一个“附件清单”:
```text
附件:
图1:姜尚离_百姓装_主形象.png
图2:霍念_粗布农夫_主形象.png
图3:伯府狗洞_泥地_场景.png
图4:旧玉佩_道具.png
提示词:
参考图1作为姜尚离的外貌、发型和服装;参考图2作为霍念的外貌和服装;参考图3作为场景空间和光线;参考图4作为旧玉佩道具。生成……
```
## 参考职责写法
每个附件必须有明确职责,避免模型把背景、姿势、服装、表情混用:
- 角色图:锁定外貌、发型、服装、固定识别点;不参考原图背景和姿势,除非本段明确需要。
- 场景图:锁定空间结构、材质、光线方向;不改变角色身份。
- 道具图:锁定外观、尺寸、材质;不新增危险用途说明。
- 视频参考:只锁定动作节奏、镜头路线、运动速度;不复制视频中的人物身份。
- 音频参考:锁定节奏、氛围、对白语气或环境声方向;如果本段由 Seedance 生成声音,对白/VO/环境音必须写进 Seedance Prompt。
同一条提示词建议使用 2-5 个核心附件;除非确有必要,不要把所有全局资产都塞进同一个任务。
## API 写法
通用结构:
```json
{
"prompt": "@Image1 as Jiang Shangli character reference, @Image2 as Huo Nian character reference, @Image3 as the alley scene reference. ...",
"image_urls": [
"https://example.com/jiang-shangli.png",
"https://example.com/huo-nian.png",
"https://example.com/alley.png"
],
"duration": 12,
"resolution": "720p",
"aspect_ratio": "9:16"
}
```
不同 API 服务商字段名可能不同:
- 有的用 `image_urls`
- 有的用 `content: [{"type":"image_url", ...}, {"type":"text", ...}]`
- 有的需要先获取预签名上传 URL,再用返回的 `file_path` 提交任务。
## 本工作流输出要求
每条即梦和 Seedance 提示词必须同时输出:
1. `内部引用``@姜尚离_百姓装`
2. `官网附件清单`:图1、图2、图3分别上传什么。
3. `参考职责`:每张图/视频/音频负责锁定什么,不参考什么。
4. `官网提示词`:用“参考图1/图2/图3”写。
5. `API映射``@Image1 = @姜尚离_百姓装`
6. `API提示词`:用 `@Image1/@Image2` 或“参考图1/图2”写。
@@ -0,0 +1,47 @@
# 图片资产模型服务商规则
## 输出策略
本工作流默认同时输出两套图片资产提示词:
```text
MJ版
nano-banana-2版
```
用户后续自行选择服务商。如果项目 `config.md` 明确指定只输出某一个服务商,可以按配置精简。
## 共同母版
无论使用 MJ 还是 nano-banana-2,都先生成一份“高密度中文资产设定板母版”:
- 人物:基础档案、核心外貌、固定识别点、6种表情、半身、全身、三视图、服装配件拆解。
- 场景:主视角、反向视角、俯视平面图、局部特写、光线、材质。
- 道具:正面、侧面、背面/底部、手持比例、使用状态、材质特写。
## nano-banana-2 版
适合高密度中文设定板、中文标签、多图组合、局部编辑和一致性扩展。写法上保留“一张图内包含多个视角/模块”和“简洁中文文本标签说明”。
## MJ 版
适合美术概念探索、角色气质、服化道氛围和风格化写实参考图。正文仍输出中文,末尾可添加 `--ar 16:9 --style raw --v 7`。如果中文标签渲染不稳定,把“配有中文文本标签说明”改成“整洁设计稿标签区,文字后期添加”。
## 可选推荐模型
| 模型/服务 | 适合用途 | 备注 |
| --- | --- | --- |
| nano-banana-2 / Nano Banana Pro | 高密度设定板、中文标签、多图组合、局部编辑 | 生产默认推荐之一 |
| Midjourney | 氛围图、美术概念图、服化道风格探索 | 生产默认推荐之一 |
| Imagen 4 / Google Imagen 系列 | 高质量写实单图、产品/场景资产 | 可作为备选 |
| GPT Image / OpenAI Images | 复杂指令跟随、设计板、局部编辑 | 可作为备选 |
| 即梦图片模型 | 中文审美、国内平台兼容、快速出图 | 适合补充测试 |
## 配置字段
```md
图片模型:both
图片模型可选:mj,nano-banana-2
资产提示词格式:高密度中文设定板
```
@@ -0,0 +1,36 @@
# 旧分镜参考说明
用户提供的旧文件:
`C:/Users/27698/Documents/xwechat_files/wxid_7vpo6s9xqklw22_8bcf/msg/file/2026-05/第一集分镜.md`
使用方式:只作为字段和表达密度参考,不作为标准答案。
## 可保留的优点
- 有系列视觉母题,例如“门”。
- 有角色身体语言演化,而不只是人物简介。
- 有场景空间锚点、光线基准和材质声音。
- 有片段内多镜头序列,适合 15 秒视频段。
- 有衔接快照,便于下一段接住尾帧。
- 有自检表,能减少对白遗漏、时长失控和角色不一致。
## 需要修正的问题
- 过度细密时,单个提示词可能超出视频模型的执行能力。
- 有些镜头时长过短,适合并入多镜头序列,而不是单独生成。
- 需要把“文学化描写”转换成 Seedance 可执行的动作、构图、镜头和尾帧。
- 需要单独输出 Midjourney 资产提示词,旧文件里角色参考图策略还不够完整。
- 需要建立 `@角色``@场景``@道具` 的命名规则,保证后续批量制作。
## 新工作流继承字段
- 系列视觉架构
- 情绪弧线
- 角色锚点
- 场景空间档案
- 分镜片段
- 音频设计
- 衔接快照
- 全集自检
@@ -0,0 +1,61 @@
# Midjourney 角色与场景资产规则
## 资产制作顺序
1. 人物主形象图:确定脸、年龄、体态、发型、服装和固定标记。
2. 人物三视图:正面、侧面、背面,同一服装,同一光线。
3. 表情表:同一角色、同一服装、同一构图,只变化表情。
4. 场景空镜:先生成无人场景,锁定空间结构和光线。
5. 关键道具图:需要跨分镜复用的道具单独生成。
6. 视频参考图:把最稳定的角色图、场景图作为 Seedance `@角色``@场景` 来源。
## 输出语言与密度
本工作流默认只输出中文资产提示词。人物、场景、道具提示词必须使用高密度设定板格式。详见 `rich_asset_prompt_rules.md`
人物提示词不得只写简短三视图;必须包含:
- 基础档案
- 核心外貌特征
- 固定识别点
- 6 种表情组
- 半身大特写
- 全身完整立绘
- 全身三视图
- 服装与配件拆解平铺
场景和道具也必须在一张图中输出多个视角和局部特写。
## 人物高密度设定板模板
使用 `rich_asset_prompt_rules.md` 中的人物模板。优先生成一张 16:9 或 3:2 角色设定板,而不是单张头像。
如需单独三视图,再输出简化三视图补充版。
## 表情表模板
```text
expression sheet of the same character, 6 facial expressions, neutral, restrained anger, shock, cold smile, exhaustion, decisive calm, same face, same hairstyle, same outfit, clean background, realistic cinematic portrait, no text, no watermark --ar 16:9 --style raw --v 7
```
## 场景参考图模板
```text
--- 场景:{场景名称} · 多视角设定板 ---
风格:真人实景实拍写实风格。纯白或浅灰留白背景上的场景设定板,一张图内包含主视角宽幅图、反向视角图、俯视平面图、3个局部特写,所有小图水平对齐,带简洁中文标签。{空间结构},关键道具:{道具列表},光线:{色温/方向/光质},材质:{材质}。不要人物,不要水印,不要乱码文字,不要现代物品 --ar 16:9 --style raw --v 7
```
## 道具参考图模板
```text
--- 道具:{道具名称} · 多角度拆解图 ---
风格:真人实景实拍写实风格。纯白背景,一张图内包含正面、侧面、背面/底部、手持比例图、使用状态图、材质局部特写,带简洁中文标签。{材质/颜色/使用痕迹}。不要水印,不要乱码文字,不要多余道具,不要现代元素,不要危险制作步骤 --ar 16:9 --style raw --v 7
```
## 一致性建议
- 人物图不要从一开始就加入复杂场景,先锁脸和服装。
- 三视图里不要让人物做戏剧动作,避免后续参考混乱。
- 如果使用 Midjourney 参考参数,角色一致性优先使用角色/全身参考图,风格一致性再使用风格参考图。
- 角色资产命名要稳定:`@苏清颜_主形象``@苏清颜_三视图``@苏清颜_表情表`
- 场景资产命名要稳定:`@医院走廊_冷白灯``@院长办公室_午后`
@@ -0,0 +1,162 @@
# 去 AI 感表演提示词规则
## 问题判断
AI 感常见来源:
- 情绪词太直接:愤怒、震惊、悲伤、冷笑、崩溃。
- 动作太完整:每个动作都精准开始、精准结束,像舞台调度。
- 表情太满:眼睛瞪大、嘴角上扬、眉头紧皱同时出现。
- 镜头太炫:频繁推拉摇移、慢动作、特写堆叠。
- 人物无事可做:只站着“表达情绪”,没有生活化小动作。
- 每句话都像台词:缺少停顿、吞字、没说完、改口。
## 核心原则
写提示词时不要让人物“演情绪”,要让人物“处理一件事”。
把:
```text
她愤怒地看着姐姐,眼神冰冷,表情充满恨意。
```
改成:
```text
她没有立刻说话,视线先落在姐姐捏紧帕子的手上,又慢慢抬到姐姐眼睛;下颌轻轻收住,呼吸停了半拍,手指按住袖口,没有爆发。
```
## 表演提示词结构
每个角色动作按这个顺序写:
```text
当前任务 → 微停顿 → 视线落点 → 小动作 → 情绪压住 → 动作未完全完成
```
示例:
```text
姜尚离刚从地上站稳,先低头看自己被泥染脏的指节,停半秒,再看向霍念;她想抽手,又没有抽走,只把旧玉佩往衣襟里按了一下。
```
## 反 AI 感动作库
### 真实停顿
- 没有立刻回答。
- 手伸到一半停住。
- 呼吸停了半拍。
- 话到嘴边又吞回去。
- 眼神先避开,再慢慢看回去。
- 动作比正常慢半拍。
### 视线落点
- 看向对方的手,而不是直接看眼睛。
- 视线落在门槛、衣袖、玉佩、帕角、泥点、车帘。
- 先扫过周围人的反应,再看回对方。
- 眼睛短暂失焦,像在确认自己不是做梦。
### 手部微动作
- 指腹摩挲玉佩裂纹。
- 指尖压住袖口折痕。
- 捏紧帕角后又松开。
- 手指在桌沿停住,没有敲下去。
- 拇指擦掉指节上的泥,却只擦了一半。
### 身体重心
- 重心微微后移,但脚没有退。
- 肩膀先塌一下,随后重新撑住。
- 站起时膝盖短暂不稳。
- 转身前先停住半步。
- 被推后只退半步,马上稳住。
### 不完整动作
- 想扶人,但手停在半空。
- 想笑,嘴角只动了一下。
- 想反驳,吸了一口气后沉默。
- 想抽手,但最后没有抽走。
- 想回头,最后只偏了一下眼。
## 避免词
少用或不用:
- 愤怒地、悲伤地、震惊地、冷笑、崩溃、邪魅、霸气、杀气、黑化、破碎感、宿命感、眼神拉丝。
- 极致、疯狂、狠狠、猛地、歇斯底里、泪流满面。
- 电影感拉满、大片质感、超震撼、神级表演。
可替换为:
- 下颌收紧。
- 呼吸变浅。
- 眼神停住。
- 手指用力到指节发白。
- 肩线短暂下沉。
- 嘴唇动了一下,没有出声。
## 镜头去 AI 感
- 每段最多 1 个明显镜头运动,其余用固定镜头或轻微手持。
- 少写“快速推近、环绕、升格、慢动作、极致特写”。
- 多写生活化遮挡:门框、车帘、人群肩膀、烛台、帕子边缘。
- 允许画面有轻微不完美:人物不完全居中,前景短暂遮挡,动作有半秒延迟。
- 不要每个镜头都要求“完美构图”和“锐利眼神”。
## Seedance / 即梦可追加的自然表演约束
```text
自然克制的真实演员表演,动作不要夸张,不要舞台化,不要网红短剧式瞪眼和冷笑;表情变化幅度小,通过停顿、呼吸、视线落点和手部小动作表达情绪;人物动作允许有轻微迟疑和未完成感。
```
负面约束:
```text
不要夸张表情,不要瞪眼,不要邪魅冷笑,不要用力哭喊,不要舞台剧动作,不要机械微笑,不要僵硬站姿,不要所有人同时转头,不要过度慢动作。
```
## MJ 角色资产去 AI 感
人物参考图也会影响视频表演。MJ 图不要生成“情绪大片脸”,要生成自然演员状态:
```text
natural candid actor reference, relaxed neutral face, subtle asymmetry, normal skin texture, no glamour retouching, no exaggerated expression, no dramatic pose
```
避免:
```text
perfect face, intense gaze, cinematic dramatic expression, flawless skin, powerful aura
```
## 旧提示词改写示例
原:
```text
姜尚瑶眼里没有泪,只有快意,露出一瞬冷笑。
```
改:
```text
姜尚瑶的帕子停在眼角,眼角是干的;她的视线从姜尚离肩头滑到伯爷脸上,嘴角只轻轻动了一下,立刻又压回柔弱表情。
```
原:
```text
姜尚离脸上有泥,眼神却清亮坚定。
```
改:
```text
姜尚离抬脸时先眨了一下,泥水从下巴边缘滑过;她没有急着说话,只低头看了一眼霍念的手,再把自己的手放上去。
```
@@ -0,0 +1,76 @@
# MJ / 即梦 / Seedance 提示词安全规则
## 资料来源
- Midjourney Community Guidelines: `https://docs.midjourney.com/hc/en-us/articles/32013696484109-Community-Guidelines`
- Midjourney Terms of Service: `https://docs.midjourney.com/hc/en-us/articles/32083055291277-Terms-of-Service`
- 即梦AI用户服务协议: `https://lf9-cdn-tos.draftstatic.com/obj/ies-hotsoon-draft/vco/17620dba-f821-4a18-85f9-b8b11f73304a.html`
- Dreamina Terms of Service: `https://dreamina.capcut.com/clause/dreamina-terms-of-service?store_region=us`
说明:平台规则会更新,本文件用于制作前的保守风控,不能保证 100% 通过平台审核。
## 检测等级
| 等级 | 含义 | 处理 |
| --- | --- | --- |
| OK | 无明显风险 | 可输出 |
| LOW | 有轻微戏剧冲突或古言权力压迫 | 保留,增加负面约束 |
| MEDIUM | 有毒、药、暴力、羞辱、押解、火灾等敏感元素 | 自动改写后输出 |
| HIGH | 成人暗示、血腥、具体伤害方法、未成年人风险、真实人物权益 | 删除细节,改成安全替代表达 |
| BLOCKED | 明确色情、露骨暴力、自残教程、违法教程、仇恨煽动、政治操纵等 | 不输出原提示词,只输出安全替代方案 |
## 高风险类别
- 成人/性暗示:通房、青楼、助兴药、衣衫不整、挑逗、裸露。
- 未成年人风险:未成年角色与性、暴力、剥削同时出现。
- 血腥和惊悚:毒杀、尸体、伤口、鲜血、残忍、凶杀细节。
- 暴力和危险行为:自残、酷刑、具体伤害方法、危险器械教程。
- 违法犯罪:投毒细节、制毒、规避执法、诈骗。
- 政治和公共安全:真实政治人物、现实政权煽动、谣言。
- 仇恨/歧视/侮辱:针对群体的贬损。
- 真实人物和权益:真实名人肖像、商标、可读官方文书、隐私信息。
## 平台差异
### Midjourney
- 更保守地保持 PG-13。
- 避免 NSFW、成人暗示、血腥、仇恨、骚扰、误导性真实人物图像。
- 不要写“未成年少女”与任何暴力/性/剥削语境同现;角色可写“young adult woman”。
- 不生成可读官方文件、真实品牌、真实公众人物。
### 即梦 / Dreamina
- 中文提示词审核更容易识别敏感词,优先使用温和表达。
- 避免色情、血腥惊悚、暴力凶杀、自残、危险行为、违法犯罪、政治敏感和侵权。
- AI 内容如要发布,应按平台/法规要求保留或添加 AI 标识,不要要求去除平台标识。
- 对“投毒、助兴药、青楼、通房、凶杀、尸体、踹飞、血”等词做强制改写。
### Seedance
- 视频动作更容易触发“暴力/危险动作”观感,动作描述要强调影视化、无血腥、无伤害细节。
- 可保留戏剧冲突,但避免具体伤害方法和冲击性画面。
- 负面约束加入:不要血腥、不要伤口特写、不要色情暗示、不要危险动作教程。
## 常用改写表
| 原风险表达 | 安全替代表达 |
| --- | --- |
| 毒杀 | 暗害、危险药痕、突然倒下 |
| 淬毒 | 藏着危险药痕、被动过手脚 |
| 助兴药 | 来路不明的危险药瓶、不合规药物 |
| 青楼 | 灯红酒绿的旧巷、来路复杂的地方 |
| 通房 | 被迫依附、失去体面处境 |
| 踹到墙上 | 猛地逼退到墙边、肩背撞到墙面,无血腥细节 |
| 血、伤口、尸体 | 倒地不起、画面避开伤害细节 |
| 凶杀、残忍 | 危险冲突、致命阴谋 |
| 圣旨清晰文字 | 明黄卷轴、不可读官方文书感 |
| 未成年少女 | 年轻成年女性、年轻女子 |
## 每集安全审查输出格式
```text
| 文件 | Prompt编号 | 平台 | 初始风险 | 风险点 | 改写动作 | 最终风险 |
| --- | --- | --- | --- | --- | --- | --- |
```
@@ -0,0 +1,132 @@
# 高密度资产参考图提示词规则
## 目标
人物、场景、道具资产提示词必须输出为“可直接生成参考设定图”的高密度中文提示词,而不是简短描述。
要求:
- 只输出中文提示词。
- 人物参考图优先生成“一张图内的完整角色设定板”。
- 场景和道具也要在一张图里包含多个视角/拆解图。
- 提示词要服务后续 Seedance/即梦 API 的角色一致性和场景一致性。
## 人物参考图标准结构
每个主要人物至少输出以下模块:
1. 标题:`--- 角色序号/总数:角色名 · 阶段/服装 ---`
2. 风格与背景:真人实景实拍写实风格,纯白或浅灰背景。
3. 角色名与基础档案:姓名、性别、年龄、身份、民族/时代气质、身高。
4. 核心外貌特征:脸型、眼型、眉形、鼻梁、唇形、肤色、发型、体态。
5. 固定识别点:伤痕、耳饰、玉佩、手表、发簪、衣料、惯用道具。
6. 表情组:6 种表情,每种表情写“可见微动作”,不要只写情绪名。
7. 半身大特写:镜头范围、面部、头发、上半身服装、关键配件。
8. 全身完整立绘:站姿、服装、鞋履、比例、手部状态。
9. 全身三视图:正面、侧面、背面,严格水平对齐,纯白背景。
10. 服装与配件拆解平铺:衣服、鞋履、首饰、随身道具,带中文标签。
11. 负面约束:不要文字错误、不要水印、不要多余人物、不要现代元素等。
## 人物提示词模板
```text
--- {序号}/{总数}{角色名} · {阶段/服装} ---
人物:风格:真人实景实拍写实风格。纯白色背景。角色名:{角色名}。基础档案:{性别},{年龄}岁,{身份/职业/地位}。{时代/地域/族群气质}。身高{身高}cm。
核心外貌特征——{发色发型};{眼睛和眉形};{脸型、颧骨、下颌、鼻梁、唇形};{肤色和皮肤质感};{体态和身形,但避免低俗性暗示}。
固定识别点——{伤痕/饰品/玉佩/手表/发簪/指甲/手部特征}。
表情组(6种情绪)——
平静:{眉眼、嘴角、呼吸、视线落点};
喜悦:{笑容如何出现,是否对称,眼睛变化};
压抑不悦:{眉、下颌、手指、肩线变化};
悲伤/失落:{眼睑、唇线、呼吸,但不要夸张落泪};
惊讶:{停顿、眼神、嘴唇微张幅度}
厌恶/警觉:{鼻翼、视线、身体重心}。
角色半身大特写:镜头聚焦面部和上半身。{面部中心视觉点};{头发落点};{上半身服装材质、领口、肩线、袖口};{关键饰品进入画面}。纯白色背景。
全身完整立绘:{站姿},{体态关键词}。穿{服装详细描述:颜色、材质、版型、长度、腰线、袖口、纹样};脚穿{鞋履};{手部动作和道具位置};{头发长度和背面轮廓};{固定识别点再次出现}。纯白色背景。
全身三视图:正面展示{正面重点};侧面展示{侧面轮廓、发型、衣摆层次};背面展示{背部结构、发型背面、衣摆垂坠}。三视图严格水平对齐,比例一致,纯白色背景。
服装与配件拆解平铺:{主服装}悬浮正面展开,展示{结构细节};{鞋履}成对悬浮;{饰品/道具}悬浮;以上所有部件均配有简洁中文文本标签说明。
负面约束:不要水印,不要乱码文字,不要多余人物,不要现代物品,不要夸张网红脸,不要过度磨皮,不要低俗性暗示,不要裸露,不要血腥。
```
## 场景参考图标准结构
场景必须输出“一张图内多视角设定板”,至少包含:
- 主视角宽幅场景图。
- 反向视角。
- 俯视平面布局。
- 关键局部特写 3-5 个。
- 光线/色温说明。
- 材质和声音锚点。
- 中文标签。
### 场景模板
```text
--- 场景:{场景名} · 多视角设定板 ---
风格:真人实景实拍写实风格。纯白或浅灰留白背景上的场景设定板,一张图内包含多个视角和局部拆解,所有小图水平对齐,带简洁中文标签。
主视角宽幅图:{空间结构、主体区域、人物可站位、主要道具}。
反向视角图:从主视角相反方向看,展示{门、窗、出口、遮挡物、纵深关系}。
俯视平面图:展示{入口、出口、桌椅、通道、关键道具的位置关系}。
局部特写A{关键道具/材质}。
局部特写B{灯光/门窗/地面}。
局部特写C:{可交互道具或叙事锚点}。
光线设定:{色温、方向、光质、明暗分布}。
材质设定:{地面、墙面、布料、木料、金属、尘土等}。
氛围:{情绪和声学空间,但不要抽象堆词}。
负面约束:不要人物,不要水印,不要乱码文字,不要现代物品,不要可读官方文书,不要血腥,不要恐怖惊悚。
```
## 道具参考图标准结构
道具必须输出“一张图内多角度拆解”,至少包含:
- 正面、侧面、背面/底部。
- 手持比例图。
- 使用状态图。
- 材质局部特写。
- 中文标签。
### 道具模板
```text
--- 道具:{道具名} · 多角度拆解图 ---
风格:真人实景实拍写实风格。纯白背景,一张图内包含多角度道具拆解,带简洁中文标签。
正面视图:{形状、颜色、纹理}。
侧面视图:{厚度、结构、边缘细节}。
背面/底部视图:{背面结构、磨损、连接方式}。
手持比例图:一只自然手部轻拿道具,展示真实尺寸比例。
使用状态图:{道具在剧情里的状态,不写危险制作细节}。
材质局部特写:{裂纹、布料、金属反光、木纹、泥痕等}。
负面约束:不要水印,不要乱码文字,不要多余道具,不要现代元素,不要危险制作步骤,不要血腥。
```
## 安全与审美边界
可以详细描写成年角色的体态、服装剪裁和气质,但不要使用过度性化或低俗表达。把“性感/性张力/胸围杯数/诱惑”改成:
- 成熟明艳
- 冷艳
- 曲线感明显
- 收腰剪裁
- 体态挺拔
- 妆容锋利
- 视觉压迫感
这样能减少 MJ/即梦审核风险,也能让角色更像影视人物设定,而不是擦边图。
@@ -0,0 +1,177 @@
# Seedance 2.0 提示词规则
## 依据
本规则于 2026-05-17 复核,综合以下资料整理:
- ByteDance Seed 官方 Seedance 2.0 页面:支持 text/image/audio/video 多模态输入,强调表演、光影、镜头运动的导演级控制。
- Seedance 2.0 技术报告/Model Card:支持 4-15 秒音视频生成,原生 480p/720p;开放平台参考输入可包含最多 3 个视频、9 张图片、3 段音频。
- 火山引擎公开材料:Doubao-Seedance-2.0 已开放 API,重点能力是音视图文参考、一致性、拟真稳定性和批量生产。
- 第三方实测教程的共同结论:提示词越像“镜头 brief”越稳定;不要把设定、推理、流程、后期说明揉进一个生成提示词;图生视频不要反复重写图片中已有物体,只写运动、镜头、光线变化和情绪走向。
## 项目内文件分工
- `01_WORKFLOW.md`:执行流程、产物结构、命名规则。
- `references/seedance2_prompt_rules.md`Seedance 写法规则。
- `templates/episode_05_seedance_prompts.md`:只放可复用输出骨架。
- `episodes/EPxx_中文集名/05_seedance_prompts.md`:只写本集视频段落提示词。
- `episodes/EPxx_中文集名/06_transition_snapshots.md`:只写片段衔接,不塞进 Seedance Prompt。
- `episodes/EPxx_中文集名/09_official_site_prompts.md`:只写官网上传素材版。
- `episodes/EPxx_中文集名/10_api_payloads.jsonl`:只写 API 请求体。
## 最稳结构
Seedance Prompt 代码块内只放“生成这个视频片段需要模型知道的信息”。不要放分析过程、为什么这样写、QC、风险审查、模板说明。
推荐顺序:
```text
参考职责:参考图1锁定{角色外貌/服装},参考图2锁定{场景空间/光线},参考图3锁定{道具外观}。
{景别/镜头类型},{主体 + 核心动作 + 场景},{时长}s,{画幅},{写实/风格}。
首帧:{人物位置、姿态、道具、光线}。
镜头:{一个主要镜头运动,或明确为固定镜头;写清起点 -> 运动 -> 终点}。
时间节拍:0-3s {动作1}3-7s {动作2}7-12s {动作3}。
对白/口型/表演:{本段由 Seedance 生成的对白、语气、口型、停顿、听者反应;视线、呼吸、手指、身体重心等可见细节}。
声音:{对白发声方式、环境音、是否有 VO、是否有音乐;声音必须服务画面动作}。
环境:{光线、材质、风、烟、背景人群等}。
一致性:{角色脸、服装、道具、场景结构保持参考图一致;只允许写明的变化}。
尾帧:{最后0.5秒画面,用于下一段衔接}。
约束:{少量关键负面约束}。
```
## 生成模式选择
每条提示词先判断模式,再写正文。不要用同一种写法覆盖所有场景。
### Text-to-Video
适合没有参考素材、做概念测试或空镜。必须完整写清主体、动作、环境、光线、风格和画幅。角色类视频不建议长期依赖纯文生视频,因为跨片段一致性更难控制。
### Image-to-Video
适合角色、场景、道具已经有参考图的正式片段。写法重点:
- 不要重复堆角色脸型、五官、服装细节;只写“参考图1锁定外貌和服装”。
- 不要重新描述图片里的每个物体;只写要发生的动作、镜头运动、光线变化和尾帧。
- 如果上传首帧图,首帧描述必须贴合图片,不要让首帧与参考图冲突。
- 如果图片里缺少关键道具或角色,不要指望文字硬补;优先补一张道具/角色参考图。
### Multimodal / Omni Reference
适合需要强一致性的短剧批量生产。建议把参考素材分工写明:
- 图片:锁定角色身份、服装、道具外观、场景结构、首帧构图。
- 视频:锁定动作节奏、镜头路线、肢体运动、表演速度。
- 音频:锁定节奏、氛围、对白语气、环境音和声音方向;如果本段要求 Seedance 直接生成声音,完整对白必须写进 Seedance Prompt。
虽然开放平台可支持较多参考素材,单条正式提示词仍建议只启用 2-5 个关键参考;素材太多会增加身份、服装、空间关系冲突。
## 写法原则
1. 开头先锁主体和动作。前 20-30 个词优先写“谁在做什么、在哪里”,不要先堆“电影感、史诗感、震撼”。
2. 每段只处理一个主要动作块和一个情绪转折。复杂戏拆成多个 5-8 秒测试段,再扩展到 12-15 秒。
3. 角色一致性依赖参考图和全局资产,不要在每段重复大量脸型/服装描述;分集只写阶段状态。
4. 镜头运动只写一个主运动:固定、缓慢推进、轻微跟拍、横移、焦点转移。不要同一段同时推拉摇移环绕。
5. 多镜头必须用时间节拍写清楚。否则优先写成“连续镜头”。
6. 如果使用 Seedance 的声音/对白生成功能,完整对白、VO、环境音和必要音乐提示都写进 Seedance Prompt。对白要和时间节拍、口型、语气、听者反应绑定,不再单独当“后期备注”。如果只生成无声画面,才把声音内容另列为后期参考。
7. 负面约束保持短而关键:不要字幕、水印、变脸、额外人物、夸张表情、肢体畸变、闪烁。
8. 不能依赖内部 `@角色名` 直接让官网识别。官网版必须映射到上传素材名,API 版必须映射到 URL 或 `asset://`
## 对白、口型与声音规则
如果目标是让 Seedance 同时生成画面和声音,必须把对白写进 Prompt。不要只写“他说话”或把对白放在 Prompt 外,否则口型、语气、表情和听者反应容易脱节。
推荐采用“同段合并写法”:
- `时间节拍` 写动作和台词发生时间。
- `对白/口型/表演` 写完整台词、说话人、语气、口型、停顿和听者反应。
- `声音` 写环境音、VO、音乐和声音层级。
- `约束` 明确不要字幕、不要把对白文字显示在画面里。
推荐写法:
```text
时间节拍:0-3s 霍念把药碗推到桌沿;3-7s 姜尚离扶住碗边,低声说“我自己来”;7-12s 霍念听见后停半秒,慢慢收回手。
对白/口型/表演:姜尚离说“我自己来”,声音很低,语速慢,嘴唇动作清楚但不夸张;说话时不抬头,说完最后半秒看向霍念。霍念没有说话,只用停顿和收手回应。
声音:生成姜尚离的同期对白,屋外轻微风声,火盆细响,药碗碰到木桌有很轻的陶器声;无 VO,无背景音乐。
约束:不要字幕,不要把对白文字显示在画面里,口型自然,不要夸张张嘴,不要机械反复开合,不要多余旁白。
```
不推荐写法:
```text
姜尚离说话。对白另放在 Prompt 外:我自己来。
```
分段原则:
- 4-8 秒:最多 1 句短对白。
- 12 秒:最多 1-2 句短对白 + 1 个听者反应。
- 15 秒:最多 2 句短对白,必须用时间节拍分开;超过两句就拆成多个片段。
- 每句对白尽量短,优先 4-12 个汉字;超过 18 个汉字要拆成两句或拆段。
- 台词中的标点要服务停顿,例如“我自己来。”、“别碰她。”、“你叫我阿离。”,不要写长段文学对白。
- 如果需要精准逐字口型,仍要把台词写进 Seedance Prompt,同时接受模型可能只有近似唇形;必要时后期再精修。
## 时长与节奏
- 4-6 秒:用于动作可行性、小情绪、道具特写和镜头运动测试。
- 8 秒:正式生产的稳妥默认值,一段只写 1 个动作目标。
- 12 秒:可写 2-3 个时间节拍,适合人物关系变化。
- 15 秒:只在确实需要“起点 -> 过程 -> 结果”的连续镜头时使用,必须写时间节拍;超过 3 个动作目标就拆段。
时间节拍必须跟总时长匹配:
- 8s`0-2s / 2-5s / 5-8s`
- 12s`0-3s / 3-7s / 7-12s`
- 15s`0-4s / 4-9s / 9-15s`
## 镜头语言白名单
优先使用稳定、可执行的镜头词:
- 固定镜头:`固定中景``固定近景``静态广角建立镜头`
- 缓慢推进:`缓慢推近``低机位缓慢推近`
- 跟拍:`轻微手持跟拍``侧面跟拍``背后跟拍`
- 横移:`平稳横移``从门框后横移露出主体`
- 焦点变化:`焦点从前景道具转到人物眼神`
- 俯仰:`从手中道具轻微上摇到人物脸`
慎用或拆段:
- 同时推拉摇移、360 度环绕加快速动作、复杂跳切、闪白切回、多个时间线闪回。
- 大量正反打。Seedance 可以生成多镜头,但短剧稳定量产时优先用“一个连续镜头 + 明确节拍”。
## 参考素材职责绑定
每条官网/API 提示词都要写清参考职责,避免模型混用素材:
```text
参考图1:姜尚离外貌、发型、服装、肤色,不参考图中背景。
参考图2:霍念外貌和服装,不参考图中姿势。
参考图3:伯府狗洞场景空间、泥地材质和冷天光。
参考图4:旧玉佩道具外观和尺寸。
```
同一角色跨片段优先使用同一张主参考图;只有服装或身份阶段变化时才切换阶段参考图,并在 `04_asset_references.md` 标明。
## 连续性与返修
- 每段尾帧写成可截取的“下一段首帧候选图”:人物位置、手势、道具状态、光线方向必须明确。
- 如果平台/API 支持返回最后一帧、首尾帧控制或视频延展,优先把上一段尾帧作为下一段首帧参考。
- 首轮测试先跑 4-8 秒,确认角色脸、服装、动作和镜头稳定后再扩展到 12-15 秒。
- 返修时只改一个变量:参考图、动作、镜头、光线或约束。不要一次性重写整条提示词,否则无法判断问题来源。
## 质量检查
每条 Seedance Prompt 输出前检查:
- 是否有清楚主体、动作、场景。
- 是否有首帧和尾帧。
- 是否只有一个主要镜头运动。
- 是否明确参考素材职责,而不是只堆 `@角色/@场景`
- 是否根据 T2V / I2V / 多模态模式调整写法。
- 时间节拍是否匹配总时长。
- 是否避免过多抽象形容词。
- 是否避免把人物设定、剧情分析、风险审查塞进 Prompt。
- 是否引用了全局资产,且引用都存在于 `04_character_scene_design.md`
- 如果要求 Seedance 生成声音,对白/VO/环境音是否已经写进 Prompt,且与时间节拍和口型/表演一致。
@@ -0,0 +1,26 @@
# 检索依据
本工作流参考了以下公开资料,并按保守制作规则转化为项目规范:
- ByteDance Seedance 2.0 官方页面:`https://seed.bytedance.com/en/seedance2_0`
- Seedance 2.0 技术报告:`https://arxiv.org/abs/2604.14148`
- 火山引擎 Seedance 2.0 API 全面开放:`https://developer.volcengine.com/articles/7628567056649125942`
- 火山引擎首页 Doubao-Seedance-2.0 能力说明:`https://www.volcengine.com/`
- Seedance.tv 2026 提示词实践指南:`https://www.seedance.tv/blog/seedance-2-0-prompt-guide`
- InVideo Seedance 2.0 多模态提示词指南:`https://invideo.io/blog/seedance-2-0-prompt-guide/`
- Midjourney Omni Reference 官方文档:`https://docs.midjourney.com/hc/en-us/articles/36285124473997-Omni-Reference`
- Midjourney 官方文档入口:`https://docs.midjourney.com/`
- Midjourney Community Guidelines`https://docs.midjourney.com/hc/en-us/articles/32013696484109-Community-Guidelines`
- Midjourney Terms of Service`https://docs.midjourney.com/hc/en-us/articles/32083055291277-Terms-of-Service`
- 即梦AI用户服务协议:`https://lf9-cdn-tos.draftstatic.com/obj/ies-hotsoon-draft/vco/17620dba-f821-4a18-85f9-b8b11f73304a.html`
- Dreamina Terms of Service`https://dreamina.capcut.com/clause/dreamina-terms-of-service?store_region=us`
落地规则:
- Seedance 分段按 4-15 秒设计;8 秒适合正式稳态片段,12-15 秒必须写时间节拍。
- 角色一致性以稳定参考图、每段固定引用和明确“参考职责”为核心。
- 图片锁定身份/服装/场景/道具,视频锁定动作与镜头节奏,音频锁定节奏和氛围。
- 图生视频不要重写图片中已有对象,重点写运动、镜头、光线变化和尾帧。
- Midjourney 先生成干净角色/场景资产,再进入视频提示词。
- 小说改编不逐字搬运,优先保留冲突、选择、反转和可视动作。
- MJ、即梦、Seedance 提示词必须先做平台安全审查;中高风险词要先改写再输出。