分镜解析_v1.2.0_AI漫剧视听节奏增强版
---
name: script-to-ai-motion-drama-storyboard
version: 1.2.0
revision: AI漫劇視聽節奏增強正式框架版
description: 將短劇、AI漫劇、AI真人短劇、動畫、電影或舞臺文字轉換為劇情忠實、平臺抓人、視聽統一、AI可生成、剪輯可執行的分鏡方案。以事實鎖定、美術與聲音前置、開頭鉤子、場景路由、連續排程、NAR/RHY雙軌鏡頭授權、技術段分離和生成回測為核心。
---
# 劇本轉 AI 漫劇分鏡 v1.2.0
## 美術前置 · 聲音路由 · 平臺脈衝 · 雙軌鏡頭授權 · 生成回測
> 本檔案是可獨立執行的正式框架。案例測試、評分、評審和版本驗證應儲存在獨立報告中,不進入框架正文。
---
# 0. 版本定位
v1.2.0不把傳統電影語法機械搬進AI漫劇,也不採用“每兩秒一切”“大特寫堆疊”式平臺模板。
它解決兩個同時存在的問題:
1. **鏡頭不能為了模型時長、漂亮細節或平臺快節奏無限碎切;**
2. **AI漫劇又不能像低密度傳統長鏡那樣缺少視覺重新整理、聲音脈衝和開頭抓力。**
核心目標:
- 劇情決定主敘事鏡;
- 平臺節奏可以授權有限的節奏鏡;
- 美術和聲音在拆鏡前介入,但不能篡改劇情;
- AI生成困難優先增加技術段,確有必要時才授權AI安全切鏡;
- 開頭允許高密,情緒高潮必須保護;
- 全片必須有快慢起伏,不能從頭到尾持續轟炸;
- 每一個正式進入正片的鏡頭都必須說明存在價值。
核心流程:
```text
平臺與生產合同
→ 劇情事實與狀態鎖定
→ 四種時間閘門
→ 美術聖經與聲音聖經
→ 開頭鉤子與注意力曲線
→ 場景微單元路由
→ 連續排程與視覺重新整理設計
→ NAR/RHY雙軌鏡頭授權
→ AI技術段與安全切鏡
→ 剪輯、聲音、美術預演
→ 生成回測與返工
→ 製作、覆蓋與宣傳交付
```
---
# 1. 總體架構
```text
Gate 0|平臺與生產合同
↓
Layer 1|劇情事實、來源與連續狀態
↓
Gate A|忠實性與四種時間
↓
Layer 1.5|美術聖經+聲音聖經
↓
Layer 2|開頭鉤子+全片注意力曲線
↓
Layer 3|場景微單元路由
↓
Layer 4|連續排程+視覺重新整理設計
↓
Layer 5|NAR/RHY雙軌鏡頭授權
↓
Gate B|劇情、表演、平臺節奏與視覺負載
↓
Layer 6|AI執行、T段與RHY-AI安全切鏡
↓
Gate C|生成前執行檢查
↓
Layer 7|剪輯、聲音、美術預演
↓
Gate D|生成結果回測與返工
↓
Layer 8|製作、COV、PROMO與交付包
```
## 1.1 許可權邊界
| 模組 | 可以決定 | 不可以決定 |
|---|---|---|
| Gate 0 | 平臺、時長、畫幅、生產方式、輸出目標 | 擅自改劇情 |
| Layer 1 | 劇情事實、來源、人物與物件狀態 | 鏡頭數、風格和運鏡 |
| Gate A | 判斷內容是否裝得進目標時長 | 用快切偽造時間 |
| Layer 1.5 | 視覺統一、角色狀態、場景材質、聲音母題 | 因“好看/好聽”製造NAR |
| Layer 2 | 開頭鉤子、注意力曲線、密度區域 | 直接規定固定鏡數 |
| Layer 3 | 為每個微單元選擇敘事語法 | 直接建立正式鏡頭 |
| Layer 4 | 人物排程、焦點、環境運動、視覺重新整理 | 為景別多樣隨意切鏡 |
| Layer 5 | 決定NAR與RHY,隔離COV/PROMO/T | 增加未授權劇情 |
| Layer 6 | T段、隱藏拼接、安全切鏡、生成替代 | 透過AI限制改劇情結果 |
| Layer 7 | 剪輯、聲音與視覺節奏預演 | 回寫新劇情 |
| Gate D | 判斷生成是否滿足原方案 | 為掩蓋失敗隨意加鏡 |
| Layer 8 | 製片、VFX、資產、宣傳與備用覆蓋 | 把宣傳素材計入主鏡數 |
---
# 2. Gate 0|平臺與生產合同
正式拆鏡前必須鎖定:
| 欄位 | 填寫內容 |
|---|---|
| 專案名稱/版本 | [...] |
| 輸入範圍 | 全片 / 一集 / 連續場景 / 單場 / 單鏡 |
| 平臺 | 抖音 / 快手 / TikTok / 橫屏平臺 / 影院 / 其他 |
| 畫幅 | 9:16 / 16:9 / 2.39:1 / 其他 |
| 目標時長T3 | [...];未給則先做內容完整估時 |
| 開頭留存視窗 | 預設0–15秒;可由專案調整 |
| 臺詞鎖定 | L1逐字 / L2含義 / L3授權改編 |
| 視覺形態 | 真人寫實 / AI真人 / 二維漫劇 / 三維漫劇 / 混合 |
| 生成方式 | 文生影片 / 圖生影片 / 首尾幀 / 多圖關鍵幀 / 混合 |
| AI單段穩定時長T4 | 例如3秒 / 5秒 / 8秒 / 10秒 |
| 角色與場景繼承 | 資產編號、版本、上一場尾狀態 |
| 是否允許刪改 | 不允許 / 技術降級 / 指定授權範圍 |
| 字幕規則 | 無字幕 / 中文字幕 / 雙語 / 螢幕文字 |
| 對白口型 | 必須精準 / 允許畫外 / 允許遮擋 / 不要求 |
| 聲音交付 | 臨時音軌 / 完整設計 / 僅聲音提示 |
| 輸出模式 | M1–M6 |
| 特殊紅線 | 人物左右、不可出畫物件、暴力尺度、品牌等 |
## 2.1 繼承原則
> 繼承事實,不繼承舊答案。
必須繼承:
- 人物身份、臉、體型、服裝、傷勢、溼度、汙損;
- 場景平面、入口、出口、陳設和光線方向;
- 關鍵道具數量、歸屬、狀態和不可逆變化;
- 上一單元結束站位、視線、動作階段;
- 已確認世界規則和風格紅線。
不得預設:
- 舊鏡數;
- 舊切點;
- 舊運鏡;
- 舊ASL;
- 舊方案的優劣結論。
---
# 3. Layer 1|劇情事實、來源與連續狀態
## 3.1 七類庫存
| 庫存 | 必須記錄 | 無來源變化判定 |
|---|---|---|
| 場景 | 地點、內外、時段、時空順序 | 新場景/新時空為N |
| 角色 | 姓名、身份、是否出畫、聲音角色 | 新人物/身份變化為N |
| 臺詞 | 原句、說話者、停頓、重複、語言 | 改字/合句/換人須授權 |
| 事件 | 動作、揭示、結果、因果順序 | 新事件/新結果為N |
| 聲音 | 聲源、方向、次數、持續、主客觀 | 新聲音事件須登記 |
| 螢幕資訊 | 字幕、HUD、紙條、文字、影象 | 新增可讀資訊須授權 |
| 狀態/資產 | 位置、朝向、姿態、持物、傷勢、光線、參考圖 | 無來源變化為漂移或N |
## 3.2 來源ID
- 場景/段落:`S01-P001`
- 臺詞:`S01-D001`
- 動作:`S01-A001`
- 聲音:`S01-S001`
- 螢幕文字:`S01-H001`
- 專案聖經:`BIBLE-F001`
- 使用者本次要求:`USER-R001`
每個NAR鏡必須繫結至少一個來源ID。RHY鏡必須繫結所強化的NAR或場景來源,不能成為無來源裝飾。
## 3.3 元素級標記
| 標記 | 含義 |
|---|---|
| `E` | 原文明確事件 |
| `I` | 原文必然暗示 |
| `C` | 連續性橋接 |
| `S` | 美術/聲音/氣氛設計 |
| `R` | 平臺節奏強化,不新增劇情 |
| `N` | 新劇情、新結果、新因果 |
| `A` | 已獲授權的改編 |
| `T` | 純技術執行 |
示例:
```text
E:匕首從手中滑落
C:刀落在兩人之間的地面
S:金屬反光與地面灰塵
R:落地聲作為重逢節奏落點
```
## 3.4 比喻與主觀表達鎖
必須標註:
- `LANG-METAPHOR` 語言比喻;
- `MEMORY` 記憶;
- `IMAGINATION` 想象;
- `HALLUCINATION` 幻覺;
- `DREAM` 夢境;
- `SYMBOLIC` 象徵表達。
預設規則:
- 比喻不能自動實體化;
- VO不能逐句自動生成對應蒙太奇;
- 心理描述不能偽裝成客觀事件;
- 實體化需要A授權。
## 3.5 聲音事件鎖
| 聲音ID | 聲源 | 方向 | 次數 | 持續/瞬時 | 客觀/主觀 | 可跨鏡 | 來源 |
|---|---|---|---:|---|---|---|---|
規則:
- 原文一次聲音不能自動增加第二次;
- 餘響、回聲、主觀記憶與新一次聲音必須區分;
- 聲源方向建立後不得無故漂移;
- 聲音先行不能提前洩露本應隱藏的視覺答案。
## 3.6 連續狀態表
| 物件 | 位置/畫面側 | 朝向/視線 | 姿態/動作階段 | 持物 | 情緒 | 外觀/環境 |
|---|---|---|---|---|---|---|
下一鏡入狀態預設等於上一鏡出狀態。任何變化必須來自:
- 本鏡可見動作;
- 合理聲音提示;
- 明確時空跳轉;
- 使用者授權修改。
---
# 4. Gate A|忠實性與四種時間
## 4.1 臺詞模式
- `L1逐字鎖定`:一字不改;
- `L2含義鎖定`:允許口語化,但資訊、態度和結果不變;
- `L3授權改編`:先列授權範圍,再改寫。
預設L1。
## 4.2 四種時間
### T1|文字最低時間
對白朗讀、必要動作和必須閱讀資訊的理論最低時間。
### T2|表演執行時間
在T1基礎上加入:
- 呼吸、猶豫、哭泣、疼痛;
- 對視、反應、懸念停頓;
- 水下阻力、受傷、持物交接;
- 喜劇等待與情緒餘韻。
### T3|目標成片時間
平臺或使用者要求的成片時長。
### T4|單個AI技術段穩定時長
模型在當前任務中的可靠時長。T4只決定T段數量,不直接決定NAR或RHY數量。
關係:
```text
T4 ≠ 鏡頭時長上限
T4隻影響技術段
T3 這個鏡頭如何讓觀眾更快理解異常、人物或問題?
以下鏡頭不合格:
- 與劇情無關的環境空鏡;
- 單純展示質感的雨滴、鞋、手、嘴;
- 只有視覺衝擊,沒有人物或問題;
- 重複同一資訊的多次特寫。
## 6.3 全片注意力曲線
將全片標記為:
- `P1`低密:餘韻、沉默、情感保護;
- `P2`中密:普通劇情與關係推進;
- `P3`高密:追逐、衝突、資訊升級;
- `P4`鉤子密度:開頭、付費卡點、重大揭示。
相鄰段落應有密度或情緒變化。若全片都是P3/P4,必須主動設定呼吸段。
## 6.4 視覺重新整理間隔
“重新整理”不等於切鏡,也可以是:
- 人物移動;
- 焦點轉移;
- 遮擋揭示;
- 光線改變;
- 環境突然運動;
- 構圖重新組織;
- 新聲音進入;
- 景深或尺度變化。
內部診斷頻寬:
| 區域 | 建議視覺重新整理間隔 |
|---|---:|
| 開頭0–15秒 | 1–2.5秒 |
| 開頭15–30秒 | 2–3.5秒 |
| 普通劇情 | 3–5秒 |
| 情感對白 | 4–8秒 |
| 動作危機 | 1.5–3秒 |
| 結尾餘韻 | 4–8秒 |
該表只用於發現過靜或過密,不是切鏡指標。
## 6.5 注意力脈衝
每10–20秒至少出現一種有意義變化:
- 新資訊;
- 情緒轉折;
- 動作結果;
- 空間變化;
- 聲音衝擊;
- 視覺異常;
- 問題升級。
## 6.6 疲勞檢查
連續30秒同時滿足以下三項,判為過載:
- 高頻切鏡;
- 高音量音樂/音效;
- 高動作或高資訊;
- 多次A級視覺變化;
- 持續字幕/VO。
必須降低其中至少一項。
---
# 7. Layer 3|場景微單元路由
一場戲可以包含多種語法,先拆微單元,不以場景標題一刀切。
## 7.1 六種路由
| 路由 | 適用內容 | 首要保護 | 常見誤區 |
|---|---|---|---|
| `REL` | 對白、告白、爭執、親密 | 雙人關係、傾聽反應 | 按說話者自動切鏡 |
| `SUSP` | 威脅逼近、秘密發現、偷窺 | 資訊順序、負空間、聲音先行 | 提前展示答案 |
| `ACT` | 追逐、搏鬥、救援、交接 | 空間方向、動作因果 | 每動作階段都切 |
| `SPEC` | 爆炸、魔法、變身、風暴 | 尺度、因果鏈、人物結果 | 每個VFX結果獨立一鏡 |
| `MONT` | VO、回憶、時間壓縮 | 聽覺與視覺分工 | VO每句配一張漂亮畫面 |
| `TRANS` | 時空切換、轉場 | 新時空清楚、承接關係 | 用無關畫面掩蓋跳轉 |
## 7.2 微單元表
| 微單元 | 路由 | 平臺密度P1–P4 | 戲劇變化 | 必須看到/聽到 | 保護物件 | 結束狀態 |
|---|---|---:|---|---|---|---|
## 7.3 路由優先順序
```text
劇情因果/安全
> 空間可讀
> 表演關係
> 懸念資訊
> 型別與平臺節奏
> 奇觀展示
> 風格裝飾
```
---
# 8. Layer 4|連續排程與視覺重新整理設計
## 8.1 連續觀看單元
以下內容優先保持在一個連續觀看單元中:
- 同一雙人/多人關係;
- 同一動作空間與方向;
- 同一奇觀因果鏈;
- 同一懸念揭示過程;
- 同一語言情緒段落;
- 同一視覺問題與回答。
## 8.2 連續排程草案
每個微單元先設計:
- 起始構圖;
- 人物路線;
- 道具路線;
- 主軸與安全機位區;
- 主焦點與次焦點;
- 視覺重新整理方式;
- 人物、攝影機、環境三向量;
- 聲音進入與退出;
- 可隱藏拼接點;
- 結束構圖;
- 同鏡無法讀清的資訊;
- 同鏡無法安全生成的動作。
最後兩項為空時,不得僅為景別多樣增加NAR。
## 8.3 關係保護狀態
REL微單元滿足以下任意兩項,進入關係保護:
- 同框能看清說話者和傾聽者;
- 身體距離或高低位有劇情意義;
- 沉默反應與臺詞同樣重要;
- 道具交接屬於權力關係;
- 一方動作持續影響另一方。
保護區內,以下不能單獨觸發切鏡:
- 換說話者;
- 普通點頭、低頭、眨眼;
- 手指、衣角、眼睛等微細節;
- 僅為了更近的人臉;
- 常規過肩變化。
解除保護:
- 權力翻轉;
- 資訊揭示;
- 一方離場;
- 關係距離重大變化;
- 關鍵反應需要獨立時間;
- 同框無法讀清因果。
## 8.4 情緒保護區
以下時刻預設進入情緒保護區:
- 認出愛人;
- 告白;
- 失去記憶;
- 哭泣真正發生;
- 關係翻轉;
- 犧牲與離別;
- 重要沉默;
- 核心臺詞落點。
保護區內RHY必須證明增強情緒,否則轉COV-O。
## 8.5 奇觀因果鏈
```text
觸發 → 擴張 → 環境作用 → 人物結果 → 餘波
```
同一時空、同一方向、同一觀看任務可讀時,預設:
> 一個NAR+多個T段,必要時加入一個RHY結果鏡。
有效切開理由:
- 區域性必須切到宏大尺度;
- 空間發生變化,如海面進入深海;
- 不可替代的人物反應無法同框;
- 因果會產生誤解;
- T段與合成仍無法安全完成。
## 8.6 VO視覺負載
每個時刻最多承擔:
- 一個主要視覺理解任務;
- 一個次級氣氛任務;
- 一條聽覺資訊。
同時出現以下三項以上判為過載:
- 閱讀字幕;
- 聽VO;
- 識別新人物;
- 理解關鍵動作;
- 欣賞複雜VFX;
- 讀取道具規則;
- 理解時空跳轉。
---
# 9. Layer 5|NAR/RHY雙軌鏡頭授權
# 9A. 軌道A|劇情鏡頭授權
## 9A.1 NAR硬切理由
滿足以下任意一項,才獲得新增NAR資格:
1. 時空跳轉;
2. 必須改變觀察視點,否則關鍵事實不可見;
3. 人物關係或權力變化無法透過排程、焦點和構圖完成;
4. 動作因果或衝擊結果在同鏡無法讀清;
5. 關鍵反應需要獨立表演時間;
6. 空間方向必須重新建立;
7. 同鏡存在不可重排的競爭任務;
8. 安全、實拍、VFX或AI方案使用T段後仍無法完成連續鏡頭。
## 9A.2 NAR軟理由
以下理由單獨出現時不能建立NAR:
- 換說話者;
- 動作進入下一階段;
- 想換景別;
- 道具漂亮;
- 想加強節奏;
- 想要海報幀;
- 想增加電影感;
- 平臺偏快;
- 模型只能生成5秒;
- 分鏡多畫了一格。
---
# 9B. 軌道B|平臺節奏鏡授權
## 9B.1 RHY定義
`RHY`是正式進入正片的節奏鏡,不新增劇情事件,作用是:
- 重新整理注意力;
- 強化型別感;
- 提供聲音落點;
- 建立關鍵道具;
- 轉換視覺尺度;
- 幫助平臺開頭留存;
- 提供自然、可讀的AI切口。
## 9B.2 RHY授權條件
至少滿足一項,並透過情緒與重複檢查:
1. 當前畫面持續較久且內部沒有有效視覺重新整理;
2. 核心型別需要一次感官確認;
3. 關鍵聲音需要明確畫面落點;
4. 人物關係與環境威脅需要視覺轉級;
5. 後續關鍵道具需要提前建立;
6. 連續動作生成風險高,切開不會破壞情緒和空間;
7. 開頭鉤子需要更快建立異常、人物或問題。
## 9B.3 RHY禁止理由
以下不能單獨授權:
- 畫面好看;
- 想拍眼睛、手、嘴、雨滴;
- 想讓每兩秒都有變化;
- 模仿某位導演;
- 增加宣傳素材;
- 重複已經看清的資訊。
## 9B.4 RHY防濫用
- 連續RHY不得超過2個而沒有NAR推進;
- 情緒保護區內預設禁止RHY;
- 同一資訊不得用RHY重複確認;
- 同一主體不得連續堆疊眼睛、手、嘴、道具;
- RHY必須繫結前後NAR功能;
- RHY不應成為獨立劇情節拍。
## 9B.5 RHY診斷頻寬
| 區域 | RHY佔最終正片鏡頭的建議頻寬 |
|---|---:|
| 開頭0–15秒 | 30%–50% |
| 開頭15–30秒 | 20%–35% |
| 普通劇情 | 10%–25% |
| 情感長對白 | 0%–15% |
| 動作追逐 | 20%–35% |
| 奇觀爆發 | 15%–30% |
| 情緒高潮 | 0%–15% |
| 結尾餘韻 | 0%–20% |
該表是異常檢測頻寬,不是配額和KPI。
---
# 9C. 鏡頭分類總表
| 類別 | 含義 | 是否進入正片 | 計入正片鏡數 | 計入核心NAR |
|---|---|---|---|---|
| `NAR` | 主敘事鏡 | 是 | 是 | 是 |
| `RHY` | 平臺節奏鏡 | 是 | 是 | 否 |
| `RHY-AI` | 因AI穩定性授權的安全節奏鏡 | 是 | 是 | 否 |
| `COV-R` | 連續性/剪輯必要覆蓋 | 備用 | 否 | 否 |
| `COV-O` | 情緒、視覺、節奏可選覆蓋 | 備用 | 否 | 否 |
| `PROMO` | 海報、預告、宣傳素材 | 否,除非另行選擇 | 否 | 否 |
| `T` | 同一鏡頭內部的生成/合成技術段 | 否 | 否 | 否 |
| `PANEL` | 故事板或關鍵幀畫格 | 否 | 否 | 否 |
## 9C.1 道具特寫閾值
道具只有滿足以下任意一項,才可成為NAR:
- 不看清會誤解因果;
- 後續狀態必須複用;
- 道具發生不可逆變化;
- 道具本身完成關鍵揭示;
- 無法透過同鏡構圖或焦點看清。
僅用於型別強化、聲音落點或開頭節奏時,可授權為RHY;純美術展示歸COV-O/PROMO。
## 9C.2 切點價值卡
| 候選切點 | NAR硬理由 | RHY理由 | 不切損失 | 切開代價 | 重搜成本 | T段能否解決 | 決定 |
|---|---|---|---|---|---|---|---|
決定只能為:
- 必須NAR;
- 推薦NAR;
- 授權RHY;
- 授權RHY-AI;
- 保持連續;
- 轉COV-R;
- 轉COV-O;
- 轉PROMO;
- 僅T段。
## 9C.3 三版本鏡頭輸出
每次執行應同時提供:
1. **導演核心版**:僅NAR;
2. **平臺正片版**:NAR+被選中的RHY/RHY-AI;
3. **AI執行版**:正片鏡頭對應的全部T段。
可選附錄:COV與PROMO池。
---
# 10. Gate B|劇情、表演、平臺節奏與視覺負載
## 10.1 檢查順序
```text
人物排程
→ 空間與軸線
→ 關係/情緒保護
→ 焦點路徑
→ 美術變化
→ 聲音與畫面分工
→ 視覺重新整理
→ NAR/RHY授權
```
## 10.2 焦點路徑
每個正式正片鏡註明:
- 首要焦點;
- 次要焦點;
- 轉移方式;
- 結束焦點;
- 下一鏡焦點位置;
- 是否產生大幅視覺重搜。
動作高密段應儘量保持主體在相近畫面區域。
## 10.3 三向量
- 人物運動向量;
- 攝影機運動向量;
- 環境運動向量。
三者必須有意設計。同向推進,反向形成阻力,交叉製造混亂。
## 10.4 運鏡動機
非靜止鏡頭必須寫:
```text
起點 → 觸發原因 → 跟隨/揭示物件 → 方向速度 → 終點構圖 → 下一鏡關係
```
無明確結果時預設靜止或輕微呼吸感運動。
## 10.5 表演中斷
以下計為一次表演中斷:
- 完整臺詞中插入無新資訊的道具或環境鏡;
- 雙人關係被單純眼睛、手、衣物切開;
- 一個情緒轉折被多個同功能特寫重複解釋;
- 演員反應未落地就切到風格鏡。
必須統計每場與全片中斷次數。
## 10.6 重複解釋
資訊已清楚呈現後,後續鏡頭只有以下功能之一才可保留:
- 資訊升級;
- 關係變化;
- 狀態變化;
- 因果結果;
- 新的主觀理解;
- 有價值的聲音或型別落點。
僅“再確認一次”應刪除或轉COV。
## 10.7 視覺負載
同一時刻若同時要求觀眾:
- 聽對白/VO;
- 讀字幕/HUD;
- 識別新人物;
- 理解關鍵動作;
- 欣賞複雜特效;
- 讀取道具規則;
出現三項以上,必須重新分配。
---
# 11. Layer 6|AI執行、T段與RHY-AI安全切鏡
## 11.1 基本原則
- 一個NAR/RHY可拆多個T段;
- T段不能新增劇情、觀看任務或時空;
- T段數量不計入正片鏡數;
- AI失敗優先返回Layer 6處理;
- 只有連續方案經驗證確實不可實現,才返回Layer 5申請RHY-AI。
## 11.2 AI執行卡
| 欄位 | 內容 |
|---|---|
| 正片鏡/T段 | `N06 / T06-A` |
| 鏡頭類別 | NAR / RHY / RHY-AI |
| 參考資產 | 人物、場景、道具編號與版本 |
| 首幀狀態 | 位置、姿態、朝向、持物、表情、環境 |
| 尾幀狀態 | 可接下一段的穩定狀態 |
| 螢幕位置 | 左/中/右;前/中/後;高低位 |
| 主動作 | 一個主要可見變化 |
| 次級動作 | 不競爭的微動作 |
| 動作階段 | 準備/啟動/接觸/結果/恢復 |
| 攝影機 | 起點、方向、速度、幅度、終點 |
| 焦點路徑 | 主焦點→轉移→結束焦點 |
| 美術狀態 | 光線、顏色、材質、汙損、傷勢 |
| 聲音承載 | 對白、音錨、橋接或靜默 |
| 物理約束 | 重力、慣性、阻力、碰撞、水體、傷害 |
| 允許變化 | 表情、髮絲、衣襬、微光等 |
| 禁止變化 | 換臉、換裝、換位、換手、增刪人物/道具 |
| 隱形拼接 | 遮擋/搖鏡/白閃/水霧/穩定幀/動作停頓 |
| 風險等級 | 低/中/高/極高及理由 |
| 安全替代 | 降低技術複雜度,不改劇情結果 |
## 11.3 隱形拼接方式
- 人物或前景遮擋;
- 快速搖鏡;
- 閃電、爆炸或能量白閃;
- 水、煙、霧、雨幕覆蓋;
- 動作短暫停頓;
- 相同構圖穩定幀;
- 物體擦過鏡頭;
- 運動模糊峰值;
- 聲音衝擊掩蓋視覺拼接。
每個需要拼接的鏡頭指定主方案與備選方案。
## 11.4 RHY-AI授權條件
只有同時滿足以下條件才可新增RHY-AI:
1. 連續方案在當前模型中為高或極高風險;
2. 多T段隱藏拼接仍無法穩定;
3. 切開不破壞關係、動作方向和情緒;
4. 存在自然動作落點或聲音落點;
5. 不新增劇情、人物、道具和結果;
6. 鏡頭有平臺節奏或可讀性價值,不是純技術藉口。
## 11.5 AI漫劇運動強度
圖生影片與漫劇鏡頭優先使用:
- 單一主動作;
- 小幅人物位移;
- 可控表情變化;
- 前後景視差;
- 輕推、輕移、輕搖;
- 環境微動與區域性特效。
複雜動作、多人接觸、快速轉身、連續持物交接,應拆T段或授權RHY-AI。
---
# 12. 9:16與AI漫劇鏡頭語法
9:16不等於只能拍臉,也不等於全景無效。
## 12.1 人物關係
優先使用:
- 前後景關係;
- 一高一低;
- 肩部前景;
- 門框、貨架、樹木等縱向框景;
- 上下空間壓迫;
- 人物沿縱深接近或離開。
## 12.2 威脅
- 從人物身後、頭頂、畫面深處進入;
- 用負空間和遮擋延遲揭示;
- 保持威脅方向連續;
- 允許必要全景建立距離。
## 12.3 動作
- 主動作儘量發生在中心安全區;
- 切鏡前後主體位置不要大幅跳躍;
- 衝擊前建立方向,衝擊後展示結果;
- 不以近景掩蓋空間不清。
## 12.4 奇觀
- 可使用全景、遠景;
- 必須有人物或尺度參照;
- 縱向奇觀可利用高度與深度;
- 不能只拍空泛特效而失去劇情主體。
---
# 13. Gate C|生成前執行檢查
正式生成前逐項確認:
## 13.1 劇情
- 臺詞和事件覆蓋完整;
- 無未授權N;
- 比喻和VO未被誤實體化;
- 聲音次數與方向正確。
## 13.2 鏡頭
- 每個NAR有硬授權;
- 每個RHY有平臺功能;
- RHY未連續堆疊;
- 情緒保護區未被細節鏡打斷;
- COV/PROMO/T未混入主鏡數。
## 13.3 美術
- 角色狀態版本正確;
- 場景光線與材質一致;
- 每鏡只有一個視覺主任務;
- A/B/C視覺變化不過載;
- 禁止變化已寫清。
## 13.4 聲音
- 環境底層可跨鏡;
- 開頭S-HOOK與畫面匹配;
- 快切段有聲音連續;
- 關鍵對白不過載;
- 靜默有明確功能。
## 13.5 AI
- 每個T段首尾狀態可拼接;
- 高風險動作有替代方案;
- RHY-AI符合六項條件;
- 技術段沒有新增劇情任務。
---
# 14. Layer 7|剪輯、聲音與美術預演
## 14.1 三條時間線同時檢查
1. **畫面時間線**:NAR+RHY;
2. **聲音時間線**:對白、環境、音錨、音樂、靜默;
3. **生成時間線**:T段與拼接。
三條時間線不得混為一體。
## 14.2 開頭15秒預演
必須回答:
- 第1秒是否有截停?
- 3秒內是否看見人物或異常?
- 8秒內是否產生具體問題?
- 15秒內是否明確型別與故事承諾?
- 是否存在無功能空鏡?
- 是否靠重複特寫假裝強節奏?
## 14.3 全片節奏預演
檢查:
- P1–P4是否有起伏;
- 是否連續30秒過密;
- 情感高潮是否留出呼吸;
- 動作高潮是否空間清楚;
- RHY是否重新整理注意力而非打斷;
- 聲音是否幫助跨鏡連續。
## 14.4 美術連續性預演
檢查:
- 臉、服裝、髮型;
- 傷口、血跡、汙損;
- 屍化/變身階段;
- 雨量、水位、光線;
- 道具數量和歸屬;
- 場景破壞狀態;
- 色彩母題是否穩定。
---
# 15. Gate D|生成結果回測與返工
每個T段生成後檢查:
| 檢查項 | 內容 |
|---|---|
| 身份 | 是否同一角色、年齡和臉 |
| 人數 | 是否多出/少了人物 |
| 站位 | 左右、前後、高低是否繼承 |
| 朝向 | 身體和視線方向是否正確 |
| 持物 | 數量、左右手、狀態是否正確 |
| 動作 | 是否從上一段尾幀繼續 |
| 表演 | 情緒是否連續、是否過度誇張 |
| 美術 | 光線、材質、傷勢、汙損是否漂移 |
| 環境 | 雨、水、霧、煙、破壞狀態是否一致 |
| 攝影機 | 方向、速度、焦段是否連貫 |
| 聲音 | 對白、音效、方向與次數是否正確 |
| 拼接 | 首尾幀能否隱藏連線 |
| 劇情 | 是否出現未授權新結果 |
## 15.1 返工順序
```text
提示詞微調
→ 參考資產加強
→ 動作簡化
→ T段重拆
→ 更換隱藏拼接
→ 使用安全替代
→ 申請RHY-AI
→ 最後才返回導演層重新判斷
```
禁止為掩蓋單次生成失敗直接增加NAR。
---
# 16. Layer 8|製作、覆蓋與宣傳交付
## 16.1 製作包
按需輸出:
- 視聽簽名;
- 角色狀態資產;
- 場景視覺卡;
- 聲音母題與音錨;
- VFX分級;
- 高風險生成鏡;
- COV-R與COV-O;
- PROMO池;
- 資產清單與版本;
- 製作順序建議。
## 16.2 製作防火牆
以下不能反向改寫NAR:
- VFX成本;
- 海報需求;
- 宣傳鏡配額;
- 平臺ASL;
- 模型單段時長;
- 美術希望展示更多資產;
- 聲音希望增加更多衝擊點。
如需改劇情,必須返回Gate 0獲取授權。
---
# 17. 指標系統
ASL僅作診斷,必須同時統計:
| 指標 | 含義 |
|---|---|
| NAR數 | 主敘事鏡數量 |
| RHY數 | 平臺節奏鏡數量 |
| RHY-AI數 | AI安全切鏡數量 |
| 正片鏡數 | NAR+RHY+RHY-AI |
| T段數 | AI執行複雜度 |
| 正片鏡:T比 | 生成複雜度是否過高 |
| 關係鏡保留率 | 雙人/多人關係是否被保護 |
| 表演中斷數 | 情緒和臺詞被打斷次數 |
| 重複解釋鏡率 | 同一資訊重複確認比例 |
| 獨立道具特寫數 | 細節鏡膨脹程度 |
| RHY連續超限數 | 是否出現節奏鏡堆疊 |
| 視覺負載過載數 | 同時任務過多的鏡頭數 |
| 未授權視覺化數 | 比喻、VO、心理誤實體化 |
| 連續性錯誤數 | 位置、朝向、持物、傷勢 |
| 生成返工率 | T段失敗與返工比例 |
| 時長衝突量 | T3與T2差值 |
指標用於發現異常,不得成為新的強制KPI。
---
# 18. 輸出模式
| 模式 | 輸出內容 |
|---|---|
| `M1導演核心版` | Gate 0摘要+NAR鏡頭表 |
| `M2平臺正片版` | Hook Route+注意力曲線+NAR/RHY正片表 |
| `M3 AI執行版` | 正片表+全部T段執行卡+拼接方案 |
| `M4審計版` | 來源、臺詞、聲音、狀態、切點價值卡、指標 |
| `M5製作包` | 美術、聲音、VFX、資產、COV與PROMO |
| `M6完整包` | M1–M5全部內容 |
預設輸出M2;使用者要求生成提示詞時輸出M3;出現爭議或返工時輸出M4。
---
# 19. 正片鏡頭表模板
| # | 類別 | 時間/時長 | 路由·密度 | 景別·機位·運動 | 可見內容 | 臺詞/聲音 | 視覺重新整理 | 出狀態 | T段 |
|---|---|---|---|---|---|---|---|---|---:|
| 01 | RHY | 0:00–0:01.2 | SUSP·P4 | 特寫·靜止 | [...] | S-HOOK [...] | 聲音+顏色反差 | [...] | 1 |
| 02 | NAR | 0:01.2–0:04.5 | REL·P4 | 中近景·輕推 | [...] | [...] | 眼神轉移 | [...] | 1 |
## 19.1 NAR/RHY理由附註
每鏡簡寫:
```text
授權:NAR-關鍵揭示
或
授權:RHY-聲音落點+型別強化
```
---
# 20. 開頭鉤子輸出模板
| 時間 | 畫面 | 聲音 | 異常/問題 | 鏡頭類別 | 留存功能 |
|---|---|---|---|---|---|
| 0–1.5秒 | [...] | S-HOOK [...] | [...] | RHY/NAR | 截停 |
| 1.5–3秒 | [...] | [...] | [...] | NAR | 人物錨 |
| 3–8秒 | [...] | [...] | [...] | NAR/RHY | 第一問題 |
| 8–15秒 | [...] | [...] | [...] | NAR | 故事承諾 |
---
# 21. 美術與聲音卡模板
## 21.1 場景視覺卡
```text
場景:
空間平面:
主光方向:
色溫/對比:
前中後景:
主材質:
環境運動:
視覺母題:
A級變化:
B級變化:
允許變化:
禁止變化:
資產版本:
```
## 21.2 場景聲音卡
```text
S-BED:
S-ANCHOR:
S-HOOK:
S-HIT:
S-MOTIF:
S-SILENCE:
S-BRIDGE:
聲源方向:
聲音密度曲線:
```
---
# 22. 最終自檢清單
## 22.1 劇情
- [ ] 場景、角色、臺詞、事件、聲音和狀態庫存完整
- [ ] 每個NAR有來源ID
- [ ] 每個RHY繫結前後NAR或場景功能
- [ ] 無未授權N
- [ ] 比喻、VO和心理沒有誤實體化
## 22.2 時間
- [ ] T1/T2/T3/T4已區分
- [ ] T3短於T2時沒有偽造時間碼
- [ ] 快切沒有被用來縮短對白真實時間
## 22.3 開頭與平臺
- [ ] 1.5秒內有截停策略
- [ ] 3秒內有人物或異常
- [ ] 8秒內出現具體問題
- [ ] 15秒內出現型別與故事承諾
- [ ] 開頭沒有無功能空鏡和重複特寫
## 22.4 鏡頭
- [ ] 每個NAR有硬切理由
- [ ] 每個RHY有平臺節奏功能
- [ ] 連續RHY不超過2個
- [ ] 情緒保護區沒有被細節鏡打斷
- [ ] 道具特寫透過閾值
- [ ] COV/PROMO/T未混入正片鏡數
## 22.5 美術
- [ ] 全域視覺合同已鎖
- [ ] 角色狀態矩陣完整
- [ ] 場景視覺卡完整
- [ ] 每鏡只有一個視覺主任務
- [ ] A/B/C視覺變化不過載
- [ ] 風格和資產沒有跨鏡漂移
## 22.6 聲音
- [ ] 聲音事件次數與方向正確
- [ ] 快切段有連續聲音底層
- [ ] 關鍵對白沒有聲音過載
- [ ] 靜默具有明確功能
- [ ] J-Cut/L-Cut與畫面邏輯一致
## 22.7 AI執行
- [ ] 每個T段首尾狀態可拼接
- [ ] RHY-AI滿足六項條件
- [ ] 高風險鏡有安全替代
- [ ] 生成後已完成Gate D回測
- [ ] 未因單次失敗直接增加NAR
## 22.8 節奏
- [ ] P1–P4存在起伏
- [ ] 沒有連續30秒全面高密
- [ ] 情緒高潮保留呼吸
- [ ] 視覺重新整理不等於機械切鏡
- [ ] ASL僅用於診斷
---
# 23. 禁止事項
- 禁止按臺詞句數計算鏡頭數;
- 禁止按分鏡格數計算鏡頭數;
- 禁止“每兩秒必須切一次”;
- 禁止用模型時長直接增加NAR;
- 禁止連續堆疊眼睛、手、嘴、雨滴和道具;
- 禁止為海報、宣傳或美術展示增加主敘事鏡;
- 禁止用快切掩蓋空間不清;
- 禁止把情緒保護區拍成素材拼貼;
- 禁止用聲音爆點代替劇情鉤子;
- 禁止把VO逐句翻譯成蒙太奇;
- 禁止把COV、PROMO、PANEL和T計入正片ASL;
- 禁止在生成失敗後直接改劇情;
- 禁止把診斷頻寬變成硬配額。
---
# 24. 版本維護原則
後續升級必須遵守:
1. 框架檔案與測試報告分離;
2. 新規則必須說明解決什麼失敗;
3. 新規則不能與許可權邊界衝突;
4. 指標只能診斷,不能自動決定鏡數;
5. 平臺節奏增強不能破壞劇情忠實和表演連續;
6. 每次升級必須至少測試:
- 長對白/關係戲;
- 動作/空間戲;
- 奇觀/VFX戲;
- 9:16開頭鉤子;
- 完整AI漫劇混合場景;
7. 正式框架不得內嵌評審、評分或案例結論。
---
# 25. v1.2.0核心原則
> 劇情決定NAR;平臺節奏授權RHY;美術與聲音幫助鏡頭成立,但不擁有劇情決定權;AI困難優先增加T段,必要時才授權RHY-AI;開頭高密,情緒保護,全片有快有慢;每一個進入正片的鏡頭都必須說明它讓觀眾更快理解、感受或期待了什麼。