剧本转资产库卡
# 分鏡腳本資產提示詞模版 v2
適用目標:
根據已經寫好的分鏡腳本,只生成三類穩定資產提示詞:
- 角色
- 場景
- 道具
並且每一類資產都分別輸出三套版本:
- `NanoBanana / Gemini 圖像版`
- `開源模型版`
- `Midjourney 版`
不適用目標:
- 不直接生成逐 shot 圖像提示詞
- 不負責每個鏡頭的構圖、景別、動作凍結點
- 不把一場戲重新寫成華麗劇情摘要
這個模版的核心是:
先把全片最容易漂移的東西鎖住,再讓後續鏡頭出圖去引用這些資產設定。
---
## 一、使用前必須先問的風格問題
在真正生成任何角色、場景、道具提示詞之前,必須先問用戶這一次的圖像風格偏向。
固定先問這一步:
- 這次整體風格更偏 `真人寫實`
- 還是 `CG 電影感`
- 還是 `動漫 / 二次元`
- 如果用戶已經有參考圖,直接讓用戶上傳參考圖作爲風格錨點
推薦問法:
```text
這次的圖像整體風格想偏哪種:
真人寫實、CG電影感、還是動漫感?
如果你已經有參考圖,也可以直接發我一張,我按它來鎖風格。
```
爲什麼這一步必須前置:
- 同一個角色設定,在真人、CG、動漫三套體系裏寫法完全不同
- 場景材質和光影語言會跟着變
- 道具的表面細節、複雜度、寫實程度也會直接變化
如果沒先鎖風格,後面三種引擎版本的提示詞都會漂。
### 1.1 風格參考優先級
優先級固定如下:
1. 用戶上傳的參考圖
2. 用戶明確指定:真人 / CG / 動漫
3. 用戶只給模糊詞時,再繼續追問或先做合理假設並明確說出假設
### 1.2 風格鎖定建議維度
如果用戶給的是文字,不是圖片,儘量收斂到這些維度:
- 表現體系:真人 / CG / 動漫
- 真實度:照片級 / 寫實插畫 / 遊戲渲染 / 風格化二次元
- 光影傾向:自然光 / 電影光 / 霓虹 / 高反差 / 柔光
- 材質傾向:真實材質 / 遊戲渲染材質 / 手繪平塗 / 厚塗
- 題材氣質:現代 / 古風 / 科幻 / 民俗 / 復古
你給的 [萬能圖像提示詞生成器.md](C:/Users/Administrator/Desktop/萬能圖像提示詞生成器.md) 裏那些標籤庫,在這裏可以作爲“風格收斂參考”,但不是拿來無限發散的。
---
## 二、爲什麼改成“只生資產”
如果圖像提示詞直接逐 shot 寫,很容易出現三個問題:
- 角色每張圖都在輕微變臉、變服裝、變氣質
- 同一個場景每張圖都像換了一個地方
- 道具的重要細節忽有忽無,連續性很差
所以更穩的方式不是讓圖像層直接扛鏡頭敘事,而是先把:
- 誰長什麼樣
- 什麼地方長什麼樣
- 什麼關鍵物件長什麼樣
這三層先做成統一底稿。
一句話:
圖像提示詞層先做“美術資產聖經”,鏡頭層以後再引用。
---
## 三、和分鏡腳本怎麼對接
這個模板默認輸入來自分鏡腳本里的這些信息:
- `Scene objective`
- `Audience information order`
- `Turn / climax beat`
- `Image`
- `Purpose`
- `Blocking / staging`
- `Performance cue`
- `Director note`
但這些字段在這裏不是直接拿來寫 shot prompt,而是用來反推三種資產:
- 哪些角色必須穩定存在
- 哪些場景必須反覆出現
- 哪些道具是劇情關鍵物
判斷標準:
- 反覆出場
- 戲劇功能明確
- 連續性要求高
- 一旦漂移就會直接毀掉鏡頭可信度
---
## 四、輸出順序
建議固定按這個順序生成:
1. 角色資產卡
2. 場景資產卡
3. 道具資產卡
原因:
- 角色決定表演載體
- 場景決定空間容器
- 道具決定劇情鉤子和物理證據
並且每張資產卡都必須同時輸出三套提示詞:
1. `NanoBanana / Gemini 圖像版`
2. `開源模型版`
3. `Midjourney 版`
---
## 五、展示視角硬規則
這條規則是硬規則,不作爲可選項:
- 角色資產:默認必須輸出 `全身正面`
- 道具資產:默認必須輸出 `正面完整展示`
- 場景資產:默認必須輸出 `正向完整展示`
更具體地說:
- 角色不能再寫成半身、近景、45 度角、背面、側面
- 角色默認站立,人物全身完整入鏡,正面朝向鏡頭
- 道具默認以最能看清結構的正面完整角度展示
- 場景默認以最能看清整體結構的正向建立視角展示
如果用戶之後明確說要三視圖、轉面、特寫、局部細節,再額外加,不覆蓋這個默認規則。
---
## 六、三種引擎版本的輸出規則
這一節最重要的總原則:
- 三種引擎版本不能在“信息層級”上分裂
- `NanoBanana / Gemini`、`開源模型` 需要共享同一份高密度內部拆解
- 區別只在最終表達方式,不在信息深度本身
也就是說:
- 不是開源版寫得很細,`NanoBanana / Gemini` 卻只寫簡略摘要
- 而是這兩版都基於同一套骨架:
主體骨相、皮膚或表面質感、毛髮或邊緣結構、服裝或構造層次、環境敘事、光影路徑、色彩科學、鏡頭與成像質感
最終差異:
- `NanoBanana / Gemini`:保留完整信息,但寫成自然中文說明
- `開源模型版`:保留完整信息,但寫成最細的中文審美段落
- `Midjourney`:迴歸更簡潔的英文視覺模板,保留主體、材質、氛圍、風格和必要視角信息,不追求與開源版同等篇幅
### 5.1 NanoBanana / Gemini 圖像版
要求:
- 用中文輸出
- 用自然語言完整描述
- 不要只是一串硬標籤
- 強調穩定外觀、穩定材質、穩定氣質、穩定識別點
- 少用模型參數語法
- 角色資產必須明確寫出 `全身正面`
- 信息密度不能低於開源版,只是語氣更自然、更易讀
適用理解:
- 更像“給會讀中文自然語言的圖像模型寫設定”
- 適合角色定妝、場景設定、道具設定這類資產圖
推薦句式順序:
- 主體是什麼
- 長什麼樣 / 由什麼構成
- 顏色與材質
- 氣質與時代感
- 風格與質感要求
補充要求:
- 人物類也要寫到骨相、皮膚、髮絲、服裝層疊、姿態結構、光源方向
- 場景類也要寫到空間材質、縱深關係、光路與色彩傾向
- 道具類也要寫到表面工藝、老化痕跡、邊緣細節與成像質感
### 5.2 開源模型版
要求:
- 用中文輸出
- 輸出爲一段連貫的中文文字
- 不需要負面提示詞
- “萬能圖像提示詞生成器”裏的標籤只用於內部參考,不直接當最終輸出
- 寫法要遵守你給的專家工作流:先拆解七大要素,再做審美潤色
- 角色資產必須在正文裏明確寫出 `全身正面`、`身體朝向`、`重心位置`
內部拆解時,仍然可以參考這些維度:
- 主體類型
- 風格類型
- 光影氛圍
- 構圖視角
- 服裝造型
- 場景環境
- 材質傾向
- 質量約束
但這些維度只能作爲內部骨架,不能直接輸出成標籤池。
默認輸出結構:
```text
【開源模型版提示詞(中文段落)】
```
開源模型版強制標準:
- 嚴禁輸出標籤、序號、指令詞、參數詞
- 嚴禁把“還原參考圖”“高細節,高質量”這類控制詞生硬堆在結尾
- 描述人物時,必須包含明確的朝向、重心與站姿結構
- 角色默認全身正面,所以推薦寫法類似:
`人物全身正面站立,身體正對鏡頭,重心均衡落於雙腿,肩線平穩展開,雙臂自然下垂或按設定持物`
- 場景和道具也要寫成審美化中文段落,不輸出標籤串
開源模型版推薦內部拆解結構:
角色類資產,優先按這五層在內部拆解後再合成一段文字:
- `Subject & Essence`
解決種族骨相、臉型輪廓、皮膚微觀、眼神微表情、毛髮工程
- `Sartorial Excellence`
解決服裝層疊邏輯、織物觸覺、動態垂墜、高定或工藝細節
- `Environmental Narrative`
解決角色所處環境、空間縱深、背景遮擋與情緒敘事
- `Masterful Lighting`
解決主光源方向、光質屬性、光路造型、色彩科學
- `Optical & Film Aesthetic`
解決鏡頭焦段、透視特徵、景深邏輯、媒介質感、後期傾向
場景類資產,建議按這五層做內部拆解:
- `Core Space & Essence`
- `Material & Structure`
- `Environmental Narrative`
- `Lighting & Color Science`
- `Optical & Film Aesthetic`
道具類資產,建議按這五層做內部拆解:
- `Core Form & Essence`
- `Material & Craft`
- `Damage, Age & Patina`
- `Lighting & Color Science`
- `Optical & Film Aesthetic`
關鍵理解:
- 這五層結構是內部分析骨架
- 最終輸出仍然只能是一段中文,不把層名寫出來
- 目的不是把 prompt 寫長,而是把信息寫細、寫準、寫得可視化
### 5.3 Midjourney 版
要求:
- 以英文爲主更穩
- 重視視覺名詞、材質詞、氣質詞、風格詞
- 少寫解釋句
- 可按需要附常見 MJ 參數位
- 角色資產必須明確寫出 `full body, front view`
- 迴歸更簡潔的模板寫法,不需要把開源版的全部分析層都硬塞進去
推薦句式順序:
- subject
- key appearance
- material / color / atmosphere
- style system
- optional MJ parameters
補充要求:
- 角色類優先保留:主體身份、全身正面、核心外觀、服裝、主色、整體氛圍
- 場景類優先保留:空間類型、正向建立視角、關鍵結構、主光影、整體氣質
- 道具類優先保留:物體名稱、正面展示、核心材質、老化特徵、整體風格
注意:
- MJ 版依然是資產卡,不是鏡頭腳本
- 不要把動作過程和劇情解釋塞進去
---
## 七、角色資產卡模板
每個核心角色固定這些字段:
- 角色名稱
- 身份定位
- 年齡感
- 性別氣質
- 外貌特徵
- 髮型髮色
- 臉型與五官
- 體型與身體習慣
- 服裝體系
- 核心配色
- 職業 / 攻擊特性
- 核心技能視覺表現
- 武器 / 常用道具
- 性格 / 風格
- 視覺基準鎖定
- 連續性變化規則
字段說明:
- `身份定位` 解決這人是主角、對手、儺師、普通人還是異類
- `外貌特徵` 解決穩定臉和穩定體態
- `職業 / 攻擊特性` 解決動作方式和出手邏輯
- `核心技能視覺表現` 解決後續如果要出戰鬥圖,能量和動作不亂
- `視覺基準鎖定` 解決畫風、材質、色彩、光感統一
- `連續性變化規則` 解決受傷、破損、沾血、情緒升級時怎麼變,但不能變成本人消失
### 角色資產卡標準輸出格式
```text
【角色名稱】
【身份定位】
【年齡感 / 性別氣質】
【外貌特徵】
【髮型髮色】
【臉型與五官】
【體型與動作習慣】
【服裝體系】
【核心配色】
【職業 / 攻擊特性】
【核心技能視覺表現】
【武器 / 常用道具】
【性格 / 風格】
【視覺基準鎖定】
【連續性變化規則】
【NanoBanana / Gemini 圖像提示詞(中文)】
【開源模型版提示詞(中文段落)】
【Midjourney 提示詞】
```
角色資產卡補充要求:
- NanoBanana / Gemini 版必須直接寫出“全身正面站立”或等價表達
- 開源模型版必須在中文段落裏寫清:`全身正面`、`身體朝向`、`重心位置`
- Midjourney 版必須包含:`full body`、`front view`
---
## 八、場景資產卡模板
每個關鍵場景固定這些字段:
- 場景名稱
- 地點屬性
- 場景功能
- 時間
- 天氣
- 光源結構
- 主色溫
- 地面 / 牆面 / 空氣材質
- 建築與空間特徵
- 可反覆出現的視覺標識物
- 主空間動線
- 縱深關係
- 視覺基準鎖定
- 連續性變化規則
字段說明:
- `地點屬性` 解決這是城市邊緣、舊巷、祠堂、醫院還是屋頂
- `場景功能` 解決這是建立、追逐、召喚、對峙還是高潮空間
- `建築與空間特徵` 解決空間長相穩定
- `視覺標識物` 解決同一場在多個鏡頭裏還能被認成同一個地方
- `主空間動線` 解決人物通常怎樣穿過這個空間
- `連續性變化規則` 解決雨變大、牆裂開、燈熄滅、血跡增加時的演化方式
### 場景資產卡標準輸出格式
```text
【場景名稱】
【地點屬性】
【場景功能】
【時間 / 天氣】
【光源結構】
【主色溫】
【地面 / 牆面 / 空氣材質】
【建築與空間特徵】
【視覺標識物】
【主空間動線】
【縱深關係】
【視覺基準鎖定】
【連續性變化規則】
【NanoBanana / Gemini 圖像提示詞(中文)】
【開源模型版提示詞(中文段落)】
【Midjourney 提示詞】
```
---
## 九、道具資產卡模板
每個關鍵道具固定這些字段:
- 道具名稱
- 戲劇功能
- 基礎形態
- 材質
- 尺寸感
- 顏色與表面狀態
- 結構細節
- 使用痕跡
- 危險性 / 神祕性 / 權力感
- 被誰使用或爭奪
- 出場階段變化
- 視覺基準鎖定
字段說明:
- `戲劇功能` 解決它爲什麼重要,是鑰匙、封印物、武器還是禁物
- `基礎形態` 解決它本體到底長什麼樣
- `結構細節` 解決後續鏡頭裏觀衆能識別它
- `使用痕跡` 解決它有沒有舊、裂、血、灰、封印痕、磨損
- `出場階段變化` 解決它在不同階段的連續變化,不至於每次重畫
### 道具資產卡標準輸出格式
```text
【道具名稱】
【戲劇功能】
【基礎形態】
【材質】
【尺寸感】
【顏色與表面狀態】
【結構細節】
【使用痕跡】
【危險性 / 神祕性 / 權力感】
【被誰使用或爭奪】
【出場階段變化】
【視覺基準鎖定】
【NanoBanana / Gemini 圖像提示詞(中文)】
【開源模型版提示詞(中文段落)】
【Midjourney 提示詞】
```
---
## 十、資產提示詞怎麼寫才穩
資產提示詞優先寫這些:
- 穩定長相
- 穩定材質
- 穩定色彩
- 穩定結構
- 穩定氣質
資產提示詞少寫這些:
- 劇情過程
- 鏡頭運動
- 多個連續動作
- 空泛情緒詞堆
判斷標準很簡單:
如果這句話刪掉之後,這個角色 / 場景 / 道具依然還能被穩定認出來,就保留。
如果這句話是在講“這一刻發生了什麼戲”,就先別放進資產卡。
---
## 十一、後續怎麼給鏡頭層用
後面的逐 shot 出圖,不再重新發明角色和場景,只做“引用 + 當前瞬間”:
- 引用角色資產卡
- 引用場景資產卡
- 引用關鍵道具資產卡
- 再補這個 shot 的景別、角度、動作、主焦點
也就是說,後續鏡頭 prompt 應該變短,不該再把人物和場景從頭寫一遍。
推薦句式:
```text
使用【角色資產卡:X】+【場景資產卡:Y】+【道具資產卡:Z】,
當前鏡頭只補充:
,
,
,
,
```
---
## 十二、開源模型版的可替換接口
如果你後面給我更明確的開源模型模板,我就把“開源模型版”這一欄進一步替換成你指定的格式。
也就是說,現在先固定三件事:
- 一定有開源模型版
- 默認是一段中文審美化提示詞
- 結構化拆解在內部完成,最終輸出保持連貫
等你給出更細的開源模板後,再把字段順序、語言濃度、潤色力度精確貼合進去。
---
## 十三、最適合《夜儺》的資產拆法
如果用在《夜儺》,優先應該先做這些資產:
- 角色:男主、女主、前輩、抱紙人女孩、儺班羣體
- 場景:城市夜聲、老城區路口、巷戰區、請神現場、禁面墜地處
- 道具:紙人、舊鼓、儺釘、黑木面匣、鍾馗面、將軍面、禁面
這一步做穩了,後面逐鏡頭出圖纔不會散。
---
## 十四、最短結論
如果你的目標是穩定出圖,而不是先做鏡頭演示,
那圖像提示詞這一層只負責:
- 角色
- 場景
- 道具
而且每一類都輸出三套:
- 中文的 `NanoBanana / Gemini 圖像版`
- 中文審美化段落的 `開源模型版`
- 英文爲主的 `MJ 版`
在真正開始生成前,必須先問清楚整體風格是:
- 真人寫實
- CG 電影感
- 動漫感
或者直接讓用戶上傳參考圖。
這是更對的。
鏡頭敘事應該放在下一層,不該在資產層裏一次做完。