03:00:00省 50%領取
模式化教程+即時 Builder

MiniMax H3提示詞構建器

先選擇正確生成模式,再用 H3 官方結構建立提示詞、分配參考素材職責,並系統修復常見失敗。

01 / MODE PICKER

輸入模式決定提示詞應該控制什麼

從這裡開始。模式選錯後,模型還沒讀到鏡頭指令,輸入之間就已經發生衝突。

T2VA

文字生成影片

文字提示詞

開放式創意、廣告和電影化場景。

寫清初始構圖、一個主動作、鏡頭路徑和聲音。

開啟這個工作流程

I2VA

首幀生成影片

首圖+提示詞

控制人物身份、產品外形和構圖。

圖片負責靜態畫面,提示詞重點說明接下來如何運動。

開啟這個工作流程

FL2VA

首尾幀

首圖+尾圖+提示詞

狀態轉變和精確落到最終畫面。

只設計一條可達運動路徑,並保持兩幀構圖相容。

開啟這個工作流程

L2VA

尾幀生成影片

尾圖+提示詞

Logo 揭示、產品尾卡和預設結尾。

描述合理的前置狀態,以及元素如何逐步收束到尾圖。

開啟這個工作流程

Ref2VA

參考生成影片

圖片、影片、音訊+提示詞

遷移身份、產品、動作、運鏡或聲音。

為每個素材指定一個明確職責,並寫清必須保留什麼。

開啟這個工作流程

CONTROL RULES

四條規則避免大多數提示詞失敗

先滿足這些規則,再補電影化細節。輸入互相衝突時,堆更多詞不會解決問題。

01

先選模式

輸入類型決定提示詞應該控制什麼,不要給所有工作流程套同一個萬用公式。

02

動作量匹配時長

短影片只安排一個清楚事件,只有畫面資訊真正變化時才增加鏡頭。

03

每個參考只做一件事

拆開身份、產品、動作、鏡頭和聲音職責,避免參考素材互相爭奪控制權。

04

用正向語言寫保持條件

把模糊否定改成明確狀態:固定鏡頭、閉合嘴唇、完全一致的臉、服裝保持不變。

02 / PROMPT BUILDER

填寫一次,同時得到快速版、H3 結構版和 API 輸出

Builder 會隨 H3 模式切換對齊指令、參考標籤和 API content role。

生成模式

10s. A matte-red portable speaker remains geometrically consistent. A rim light traces the silhouette, then the speaker settles into a clean hero frame. Minimal dark studio, soft haze, precise reflections and generous negative space. The camera performs a Push In with small amplitude at slow speed. One soft dial click, restrained room tone and a synchronized low-frequency pulse. Minimal electronic percussion, moderate tempo, ending cleanly on the hero frame.

輸出會隨欄位即時更新;Prompt 建議保留英文,對白與畫面文字使用目標語言。

462/7000
帶入生成器

03 / OFFICIAL ANATOMY

基礎模式和參考模式使用不同結構

把欄位當成思考框架:先寫畫面和鏡頭,再寫畫內聲音,最後寫觀眾可聽配樂。

T2VA / I2VA / FL2VA / L2VA

基礎結構

{I2VA / FL2VA / L2VA alignment instruction when applicable}

integrated_multimodal_description:
[Shot 1] {initial composition}. {subject action}.
[Shot 2] At 00:04.000, {new visual information}.

overall_soundscape:
{ambience + physical sounds}

non_diegetic_music:
{instrumentation + tempo + dynamics}; or N/A

Ref2VA

參考模式結構

subject_definitions:
<Subject 1> is the product shown in <Picture 1>; preserve its geometry, material, color and logo.
<Video 1> is the camera-path and pacing reference.

summary:
[reference generation] {creative goal using Subject 1}

retention_analysis:
<Subject 1> (appears in [Shot 1]): fully_preserved - {exact attributes}
<Video 1> (camera and pacing structure): weak_reference - {relationship}

detailed_description:
{style sentence}
[Shot 1] <Subject 1> ...

overall_soundscape:
...

non_diegetic_music:
...

運鏡

tracking shot + medium amplitude + slow speed

對白

(S1) says <d>[Chinese] 原句</d>

配樂

instrumentation + tempo + dynamics; or N/A

04 / REFERENCE ROLES

不要只上傳素材,卻不說明它控制什麼

清楚的職責映射比增加更多參考素材更有用;必須保持的細節要在文字中再寫一次。

<Subject 1>

身份:臉、髮型、服裝

<Subject 2>

來自 Picture 2 的產品:幾何、材質、顏色

<Picture 3>

具體首幀、關鍵幀或尾幀錨點

<Video 1>

動作:步行節奏與鏡頭路徑

<Audio 1>

聲音:僅參考音色

保持條件

In Video 1, change only the original package to the exact product from Picture 1.

Preserve the actor identity, hands, timing, camera path, background and lighting.

Keep the product geometry, color and logo from Picture 1 unchanged.
編輯公式:先只寫一次要修改什麼,再列舉所有必須保持穩定的內容。

PROMPT RECIPES

三個可重用範本,每個只解決一個任務

這些是原創教學範本,不代表必然重現;每次只調整一個變數。

T2VA

高級產品主視覺

10s premium product film. A matte-red speaker in clean negative space. Slow push-in as rim light traces the exact silhouette; cut once to a macro texture shot, then settle into a stable hero frame. One soft dial click, restrained room tone, minimal electronic percussion.

使用這個 Prompt
FL2VA

準確落到預設尾幀

Picture 1 anchors 0.00s and Picture 2 anchors 8.00s. Use one continuous shot. The hand pulls the ribbon and the paper unfolds in observable stages. Every moving element gradually settles into the exact composition, lighting and hand position of Picture 2.

使用這個 Prompt
Ref2VA

只替換一個產品

In Video 1, change only the package to the exact product from Picture 1. Preserve actor identity, hands, timing, camera path, background, lighting and all other motion. Keep product geometry, color and logo unchanged.

使用這個 Prompt

05 / TROUBLESHOOTING

修復真正原因,而不是繼續堆形容詞

每次重試只改變一個控制變數,才能判斷哪條指令真正改善了結果。

症狀可能原因下一步修改
人物或產品漂移參考職責不明確,或同時承擔風格和動作。用一張乾淨圖片只負責身份,並列出必須保持的具體特徵。
鏡頭運動衝突影片參考和文字描述了不同鏡頭路徑。讓參考影片負責路徑,文字只補充速度或幅度。
對白過快或聲畫錯位台詞過長、speaker 變化,或沒有綁定時間節點。縮短台詞、保持同一 speaker ID,並放進對應鏡頭。
首尾幀突然跳變兩幀的機位、尺度差異過大,或獨立運動物件太多。從首幀編輯出尾幀,只改變一個可達狀態,並描述一條連續路徑。

06 / CONTRACT BOUNDARIES

官方 API、本站工作台和本地工作流程不是同一套合約

所有時長、解析度、參數和 model ID 都必須標註具體由哪個平台提供。

官方 API 時長

4–15s

官方解析度

768P / 2K

首尾幀比例

adaptive

文字生成影片比例

21:9 → 9:16

MiniMax 官方 API

請求 schema、model string 與能力邊界以官方文件為準。

官方 API 指南

MiniMax H3 AI Video Studio

本站可用模式、控制項、價格與限制以目前工作台顯示為準。

開啟工作台

Local / ComfyUI

按 T2V、首尾幀或參考生成選擇對應 workflow 與權重。

ComfyUI 指南

FAQ

真正影響提示詞結果的問題

模式、參考素材、對白和平台合約都應該在風格潤飾前確定。

應該選擇哪種 MiniMax H3 模式?

純文字創意用 T2VA;首幀決定構圖用 I2VA;首尾都重要用 FL2VA;預設結尾用 L2VA;需要圖片、影片或音訊控制特定屬性時用 Ref2VA。

MiniMax H3 有通用 negative prompt 欄位嗎?

不要假設所有 Provider 都有該欄位。改寫成正向保持條件,例如「鏡頭保持固定」「保留完全一致的臉和服裝」「嘴唇保持閉合」。

對白和聲音應該怎麼寫?

保持 speaker ID 一致,標註對白語言,讓台詞長度匹配時長,並把對白、環境聲、物理音效和觀眾可聽配樂分開。

託管 API 和本地 ComfyUI 的限制一樣嗎?

不一樣。權重、輸入模式、時長、解析度和參數都可能不同,必須以目前使用平台的合約為準。

來源與核驗

事實以第一手來源為準,Provider 差異必須單獨標註

內容最後核驗:2026 年 8 月 11 日。頁面範本是依據所連結結構原創編寫的教學材料。

從模式開始,而不是面對空白輸入框

先選擇與素材匹配的工作流程,在上方建立 Prompt,再帶入對應生成器。