MiniMax H3 爆紅影片:如何用 MiniMax H3 製作讓人停下滑動的 AI 短影片
2026 年爆紅短影片的配方是這樣的:一秒節奏突變、一個清晰的核心創意,以及一段在觀眾滑走之前就到位的配樂。作為生成器背後的模型,MiniMax H3 正是為此類格式而生:它能輸出原生 2K 畫質、同步的立體聲音訊,並在單次非同步任務中接受最多 12 個多模態參考素材。這意味著創作者可以讓角色的臉部、動作語言和聲音在一整週的 15 秒發布中保持一致,全程無需切換生成流程。
本指南把這些能力轉化為可直接照做的 Reels、TikTok、Shorts 以及 15 秒故事片段工作流程。你會學到:六步爆紅循環、七套結構化提示詞範本、前 3 秒就生效的鉤子公式、直式格式規格、MiniMax Audio 搭配方案、一拆六的內容再利用計畫,以及那些在 AI 影片上線前悄悄毀掉它們的常見錯誤。如需直接使用生成器,請開啟 PixMind MiniMax H3 影片工具。MiniMax H3 線上生成器
核心要點
- MiniMax H3(模型 ID
minimax/hailuo-3)輸出原生 2K 影片並帶同步立體聲音訊,每次任務最多接受 12 個多模態參考素材,這正是短影片創作者維持角色、動作與聲音一致性所需的規格。- 爆紅工作流程共六步:鉤子、腳本、鎖定參考素材、生成、MiniMax Audio 配音、加字幕並發布,然後循環。
- 直式 9:16 是短影片的主流格式;MiniMax H3 另支援 1:1、3:4、4:3、16:9 與 21:9,方便跨平台再利用。
- 計費採用量計價:2K 畫質每秒 0.13 美元,768P 畫質每秒 0.09 美元,因此一條 15 秒片段在 2K 下約 1.95 美元,768P 下約 1.35 美元。
- 鉤子決定前 3 秒的勝負;具體的鉤子公式勝過通用開場,而模型管線內的音訊能力正是實現緊湊音視覺鉤子的關鍵。
為什麼 MiniMax H3 天生適合短影片爆紅
短影片平台青睞三件事,而舊一代影片模型無法在一次生成中同時滿足。其一是交付尺寸下的細節表現,因為直式手機螢幕會放大畫面的模糊感。其二是內建音訊,因為靜音會扼殺完播率。其三是參考素材控制,因為一個爆紅角色必須在系列的每一條片段中都看起來是同一個人。
MiniMax H3 同時解決了這三件事。它能渲染原生 2K 影片,在生成畫面的同一次任務中生成同步的立體聲音訊,並接受每次生成最多 12 個多模態參考素材,其中可包含最多 9 張圖片、3 段影片和 3 段音訊,與文字提示詞一起輸入。
原生 2K 的差別在 Reels 和 TikTok 上比在長影片 YouTube 上更為關鍵。直式手機螢幕是高密度的像素網格,平台壓縮會對畫質偏軟的來源素材進行懲罰。在壓縮前就已存在的 2K 渲染,比 1080p 拉升給編解碼器留下了更多可保留的細節,這也是 MiniMax H3 片段在平台二次編碼後仍能在最終資訊流中保留細節的原因。請維持在 2K,而不是行銷文案中流傳那些未經驗證的「4K 60fps」說法;已核實的規格說明止步於原生 2K。
原生音訊是第二個力量倍增器。舊一代影片模型輸出靜音畫面,迫使創作者額外進行配音和擬音步驟。MiniMax H3 在生成畫面的同一次任務中生成對白、環境音和音效,因此一條 15 秒片段從生成器出來時就帶著完成的配樂,可以直接發布,無需後期繞路。
第三個支點是多模態參考。創作者可以提供角色參考圖、服裝參考圖、用於動作的短影片參考素材,以及用於聲音的音訊素材,模型會在一次非同步任務中把它們組合起來。這種組合能力正是系列作品得以成立的基礎:一週 7 條發布裡都是同一個角色、同一套服裝、同一個聲音。那些講解「如何在約 17 分鐘內做出一條爆紅故事影片」的社群教學經常獲得幾十萬播放量,TikTok 創作者也經常逐鏡頭拆解自己的 MiniMax H3 範例生成過程,這是一個強烈訊號:這種形式有真實需求,而不只是新鮮感。
MiniMax H3 實戰:真實爆紅影片案例
進入工作流程之前,先看看這條管線究竟能產出什麼。下方影片來自一位創作者真實、端到端的 MiniMax H3 短影片製作過程,他在約 17 分鐘內把一條提示詞變成爆紅片段,並將生成的畫面與 MiniMax Audio 搭配。
MiniMax H3 另在 Artificial Analysis 影片編輯基準測試上排名第一,並在文生影片與圖生影片兩項均位列前三,這是獨立訊號,表明這種形式有真實的上升動能,而非一時新鮮。
MiniMax H3 在 Artificial Analysis 影片編輯榜單排名第一
MiniMax H3 六步爆紅工作流程
一條爆紅短影片絕不是單一提示詞的產物,它是一個可重複循環的產物。下面這六步是真正能把一條片段從創意推進到可發布至資訊流的成品的關鍵。
第一步:先鎖定鉤子
先寫鉤子,再寫其他任何東西。決定你使用的是後面會詳細展開的四種經過驗證的短影片鉤子中的哪一種:冷開場、節奏突變、強勢斷言,還是視覺反差。鉤子決定了片段的第一秒,而第一秒決定了剩下的 14 秒還會不會被看。
一個有效的鉤子有三個屬性。它是視覺的,而不只是口述的;它拋出一個觀眾想得到答案的問題;它能用單顆鏡頭表達。如果這個鉤子只靠黑屏上的文字來呈現,那它就不是 MiniMax H3 鉤子,而是一張幻燈片。
第二步:把 15 秒寫成節拍
一條 15 秒片段在留出節奏空間後,大約能容納四個節拍:鉤子(0-3 秒)、鋪墊(3-6 秒)、高潮(6-12 秒)和點睛(12-15 秒)。每個節拍寫成一行,而不是一段。每個節拍在提示詞中會變成一條鏡頭指令。
不要試圖把 60 秒的故事塞進 15 秒。模型和觀眾都會被趕得喘不過氣。如果你要講的故事超過 15 秒,那就是一個系列,而不是一條片段,再利用章節會講如何切分。
第三步:用參考素材鎖定角色與身份
這是多數創作者會跳過的一步。在寫任何文字提示詞之前,先決定片段中什麼絕不能變:角色臉部、服裝、產品、配色、環境。然後為每個不變項分配一個參考素材。MiniMax H3 的多模態預算允許你按職責拆分參考素材:一張圖定身份、一張定服裝、一張定產品、一段影片定動作、一段音訊定聲音。
第四步:生成,然後按變數逐一迭代
提交任務,讓非同步任務跑起來。MiniMax H3 採用非同步模式:提交、輪詢、再下載。第一版渲染出來後,每次迭代只改一個變數,絕不要一次改五個。如果動作不對,就改動作描述;如果光線不對,就改光線;如果身份漂移了,就修參考素材,而不是改提示詞文字。
這裡也是選擇 768P 做迭代、把 2K 留給最終成片的合適時機。768P 為每秒 0.09 美元,迭代成本比 2K 低約三分之一,而在手機螢幕上畫質差距足夠小,因此可以在為主版本付費之前先驗證構圖、動作和鉤子。
第五步:搭配 MiniMax Audio 製作配音與對口型
如果片段需要人聲,可以同時使用 MiniMax Audio 和 MiniMax H3 來製作旁白和對口型的對白。先生成語音台詞,再把這段音訊作為參考素材回傳,讓畫面中的嘴型與台詞吻合。這就是把一條靜音渲染變成會說話的角色片段的循環,全程無需手動擬音。
用作背景配樂時,請保持音訊參考素材通用且短小。模型會基於參考素材進行創作,一段 15 秒的參考素材就足以設定節奏或情緒,又不會蓋過對白。
將 MiniMax H3 影片與 MiniMax Audio 搭配使用
第六步:加字幕、定格式,為循環發布
為匯出的片段加上字幕,鎖定直式 9:16 長寬比,並按平台建議的位元率匯出。字幕比多數創作者想像的更重要:短影片很大一部分觀看發生在觀眾點開聲音之前的靜音自動播放時段,而螢幕文字正是支撐鉤子走過這一窗口的關鍵。發布之後,關注前 30 分鐘的留存資料,找出觀眾滑走的位置,然後在下一條片段裡把這個節拍往前挪。
這六步就是循環。每條片段跑一遍,每個系列跑兩遍。
寫出讓人停下滑動的 MiniMax H3 提示詞
MiniMax H3 的提示詞是一份分鏡清單,而不是一段描述。模型獎勵去導演它的創作者,懲罰只是敘述它的創作者。一條讓人停下滑動的提示詞會把鏡頭拆成六個具名部分:景別、運鏡、光線、動作、主體和環境。每個部分佔一行。
六段式提示詞骨架
- 景別: 取景和鏡頭語言(特寫、中景、遠景、俯拍、過肩鏡頭)。
- 運鏡: 運動方式(鎖定、緩慢推進、推軌、手持、環繞)。
- 光線: 情緒和方向(溫暖窗光、硬質霓虹、柔光主光、黃金時刻)。
- 動作: 產生視覺創意的主體動作(一個主要動作)。
- 主體: 畫面中的人或物,盡可能用一張參考圖固定。
- 環境: 用一句話描述的環境,而不是一段話。
按這個順序寫每個部分。順序很重要,因為當模型不得不在相互衝突的指令之間取捨時,會更看重靠前的內容。每條提示詞都要以一行明確的「不得更改」結尾,列出那些不變項,因為正是這一行讓身份和服裝在系列的多版渲染中保持一致。
七套可直接使用的提示詞範本
這些是針對短影片平台上表現最好的幾種格式的入門範本。把方括號欄位替換為你自己的變數,並保留結尾的不變項行。

1. 冷開場產品揭曉(9:16,15 秒)
「直式 9:16。[產品]放置在[表面]上的特寫,硬質頂光,深沉陰影。運鏡:3 秒內緩慢推進,然後鎖定保持。動作:液體在產品周圍[流淌或飛濺]。主體:[產品描述、幾何形狀、標籤]。環境:極簡紋理背景,採用[配色]。音訊:輕柔的[紋理]聲,無音樂,無人聲旁白。以乾淨的產品主視覺影格結束。不得更改:產品幾何形狀、標籤位置、配色。」
2. 說話人故事片段(9:16,15 秒)
「直式 9:16。[角色]看向鏡頭的中特寫,柔和窗光主光,中性牆面。運鏡:鎖定,帶有細微的手持呼吸感。動作:角色說一句台詞,然後做出一個小反應。主體:[角色描述,以參考圖 1 為錨定]。環境:簡約室內,淺景深。音訊:對白『[短台詞]』,自然房間底噪,按照參考音訊 1 進行真實對口型。不得更改:角色身份、服裝。」
3. 節奏突變變身(9:16,8 秒)
「直式 9:16。[場景 A]的遠景,然後在第 2 秒硬切到[場景 B]。運鏡:兩個狀態都鎖定。光線:從[冷色平面光]切換到[暖色戲劇光]。動作:一個物體在剪輯點[變身、消失或複製]。主體:[主體描述]。環境:單一環境,兩個狀態之間重新布景。音訊:場景 A 下低沉持續音,剪輯點尖銳撞擊聲,場景 B 下環境底音。不得更改:主體身份、環境幾何形狀。」
4. 首尾影格故事(9:16,10 秒)
「直式 9:16。從提供的首影格自然過渡到提供的尾影格。運鏡:沿單條[路徑]以[節奏]推進。光線:[一致的情緒]。動作:主體在過渡中完成[一個主要動作]。主體:[以參考圖 1 為錨定的角色]。環境:[環境]。音訊:環境[紋理]聲,無對白。不得更改:身份、服裝、配色、構圖。」
5. 電影感空鏡循環(9:16,6 秒)
「直式 9:16。[主體]在[環境]中的緩慢追蹤鏡頭。運鏡:恆速推軌,無剪輯。光線:黃金時刻逆光。動作:主體保持在畫面中,帶有細微的[自然動作]。主體:[主體描述]。環境:[環境、天氣、一天中的時間]。音訊:環境自然音,無音樂。以與開頭一致的影格結束,以實現無縫循環。不得更改:主體、環境、光線。」
6. 視覺反差鉤子(9:16,12 秒)
「直式 9:16。[尋常物體]的特寫,然後在第 4 秒揭示[意外的背景]。運鏡:鎖定在主體上,緩慢推進揭示。光線:[中性漸變為戲劇化]。動作:主體[做尋常動作],揭示[意外事件]。主體:[主體描述]。環境:單一環境,揭示時重新布置。音訊:環境[紋理]聲在揭示時升華為尖銳提示音。不得更改:主體身份、環境幾何形狀。」
7. 多模態角色系列鏡頭(9:16,15 秒)
「直式 9:16。[角色]在[地點]的中景,對鏡頭說一句台詞。運鏡:緩慢環繞。光線:[情緒]。動作:角色說話,然後從畫面左側離開。使用參考圖 1 固定角色身份,參考圖 2 固定服裝,參考影片 1 固定節奏與肢體語言。參考音訊 1 設定聲音和台詞演繹。主體:[角色描述]。環境:[地點]。不得更改:身份、服裝、聲音。」
前 3 秒:讓人停下滑動的鉤子
一條短影片的勝負在前 3 秒就決定了。Reels、TikTok 和 Shorts 上的每條留存曲線都呈現同樣的形狀:前 1 到 3 秒急劇下滑,然後是一個較緩的尾部。鉤子的作用就是壓平最初的下滑。MiniMax H3 能在單顆鏡頭裡渲染出一個視覺鉤子,並配上同步音訊,這使第一秒能發揮比黑屏文字開場更大的作用。

四種有效的鉤子公式
冷開場從動作進行中切入。沒有鋪墊,沒有背景介紹,沒有標題卡。觀眾直接掉進某個瞬間的中段,必須繼續看下去才能搞清楚發生了什麼。對 MiniMax H3 來說,這意味著提示詞要以動作的高潮開場,且音訊提示已經響起。
節奏突變把兩種不相容的畫面並排放在一起:寧靜的物體處於充滿敵意的環境中,或熟悉的物體在做不熟悉的事。只要你保持主體不變,只在硬切時改變環境或動作,模型就能很好地處理這種形式。
強勢斷言用一行螢幕文字開場,承諾一個回報。當畫面已經在同一影格裡證實了這個斷言時,它的效果最好。不要讓斷言以文字形式疊在通用空鏡上,這會被看作填充內容並被滑走。
視覺反差讓畫面表現一件事,而音訊暗示另一件事。角色平靜地說話,身後的環境卻在變化,或一個看似靜止但其實在運動的物體。MiniMax H3 的管線內音訊讓這種形式可行,因為這種反差依賴於緊湊的音視覺同步,而靜音模型加後期配音無法實現這種同步。
鉤子構建:三條規則
第一,讓鉤子視覺化。前半秒觀眾還沒開聲音,圖像必須承擔起工作。
第二,拋出一個問題。鉤子應該讓觀眾想要下一個節拍給出的答案。沒有問題的資訊只是描述,而描述無法讓人停下手指。
第三,不要在前 3 秒就給出回報。回報是觀眾繼續看下 12 秒的理由。立刻化解張力,觀眾就沒了繼續看的理由。
直式格式與平台規格
短影片平台都匯聚到直式 9:16,但具體的匯出規格依然重要。MiniMax H3 支援 9:16、1:1、3:4、4:3、16:9 和 21:9,覆蓋所有短影片和中影片版位。對原生短影片來說,9:16 是預設選項。
| 平台 | 長寬比 | 安全時長 | 建議長度 | 備註 |
|---|---|---|---|---|
| TikTok | 9:16、1:1、16:9 | 7-15 秒最佳 | 最長 10 分鐘 | 預設開聲自動播放;建議加字幕 |
| Instagram Reels | 9:16 | 7-15 秒最佳 | 最長 90 秒 | 僅 9:16 可全螢幕顯示;封面會被裁切 |
| YouTube Shorts | 9:16 | 最長 60 秒 | 15-30 秒 | 必須 60 秒及以下才能算作 Short |
| 限時動態(IG、FB) | 9:16 | 每段 15 秒 | 每段 15 秒 | 更長的片段切分為 15 秒章節 |
| 資訊流貼文 | 9:16、1:1、4:5 | 5-30 秒 | 15 秒 | 方形和 4:5 在網格檢視中保留更多細節 |
在 MiniMax H3 中以 2K 渲染,讓平台在此基礎上壓縮。原生 2K 主版本給下游的每個編解碼器留出了更多可保留的細節,這在 TikTok 和 Reels 上尤為重要,因為那裡激進的二次壓縮會把偏軟的來源素材壓成一團糊。對於準備投入付費推廣的片段來說,原生 2K 是正確的預設選項,因為細節必須在反覆投遞和二次編碼中撐得住。
對於要在後期剪輯拼接的片段,請讓每個鏡頭保持相同的長寬比和影格率。在同一條短影片裡混用 9:16 和 16:9 素材,會迫使你加黑邊或做裁切重構,兩者都會讓最終效果變差,並吃掉字幕所在的直式安全區。
跨平台 AI 影片匯出指南
MiniMax H3 影片與 MiniMax Audio 的搭配
MiniMax H3 在生成畫面的同一次任務中生成同步的立體聲音訊,但對於需要獨立旁白、音樂或對口型對白的創作者,MiniMax Audio 可以作為互補的人聲與音樂模型與 MiniMax H3 搭配。這種雙模型組合覆蓋了單次任務無法覆蓋的場景。
旁白工作流程
先在 MiniMax Audio 中生成旁白台詞,再把得到的音訊片段作為參考回傳到 MiniMax H3 的請求中。這樣生成的片段,台詞會驅動畫面角色的嘴型和節奏。它適用於說話人故事片段、講解類格式和以對白為主的系列作品。
腳本要緊湊。一條 15 秒片段在自然對話節奏下大約容納 30 到 35 個口播詞。比這更緊會讓演繹顯得倉促;更長則迫使你切鏡頭,破壞模型最擅長的單顆鏡頭邏輯。
對口型與人聲一致性
做系列作品時,請在多次 MiniMax H3 生成中重複使用同一段音訊參考素材。人聲一致性是讓一個反覆出現的角色在不同發布之間顯得連貫的關鍵。對待人聲參考素材要像對待身份參考圖一樣:一個職責,全系列鎖定。在不同發布之間切換人聲參考素材,對連貫性的破壞幾乎比任何其他變數改動都更嚴重。
配樂與聲音設計
用作背景配樂時,請讓音訊參考素材短小且通用。模型會基於參考素材進行創作,所以 15 秒的參考素材足以設定情緒或節奏,又不會蓋過對白。對於音效,請在提示詞裡把聲音和產生它的動作一起描述。MiniMax H3 在同一次任務中生成擬音,因此玻璃杯砸到桌面可以連同撞擊聲一起渲染,而不是事後配音。
再利用:一條 15 秒片段變成一週的發布
一條 MiniMax H3 片段很少只是一條發布。如果在渲染之前就做好規劃,同一次生成可以孕育出一週的平台原生內容。
持續有效的再利用做法是:在主片段設計階段就把再利用考慮進去。把主版本渲染成 9:16 2K,但讓主體保持在畫面中央,這樣同一條片段就能裁切成 1:1 或 4:5,用於資訊流貼文而不丟失動作。匯出主版本後再切出衍生版:用於 TikTok 和 Reels 的 15 秒完整剪輯,用於限時動態的 6 秒純鉤子剪輯,以及用於 Shorts 的 30 秒加長剪輯(把主版本與同次渲染的空鏡搭配)。
工作流程第三步鎖定的那個角色和那套服裝,讓你在本週晚些時候拍攝第二條、第三條片段時,依然感覺屬於同一個系列。目標:每週一個主概念、三條衍生版、兩條配套片段。如果參考素材已鎖定,這相當於大約兩次生成產出六條發布。
用於付費推廣時,把 15 秒主版本作為主要素材,6 秒純鉤子剪輯作為再行銷素材。純鉤子剪輯面向已經看過主版本、需要二次觸達的觀眾,起到預告作用。追蹤哪條衍生版的單次觀看成本最低,並在下一輪投放把預算向那條剪輯傾斜。
AI 影片內容再利用指南
毀掉 MiniMax H3 片段的常見錯誤
多數表現不佳的 AI 短影片都敗在同樣一份簡短的原因清單上。發布前請過一遍這份清單。
在直式資訊流裡輸出橫向畫面。 為了電影感選擇 16:9 渲染,再裁切成 9:16,會丟掉大部分畫面,並以不可預測的方式重新定位主體。從第一版渲染開始就預設用 9:16。MiniMax H3 原生支援直式,所以從直式開始沒有任何畫質損失。
模糊的提示詞。 像「做一個酷酷的人在走路的影片」這樣的提示詞,讓模型沒有任何可優化的目標。請用六段式骨架,按具名行指定景別、運鏡、光線、動作、主體和環境。
忽視鉤子。 把九成精力花在畫面上、零精力花在第一秒上,就註定這條片段會在第一次上滑時死去。按工作流程第一步的要求,先寫鉤子,再寫其他任何東西。
預設美學。 當提示詞過於單薄時,MiniMax H3 會呈現一種可辨識的預設觀感。請向具體的光線、具體的配色、具體的環境靠攏。模型更獎勵導演型創作者,而不是描述型創作者。
讓多模態預算超載。 餵入九張身份相互衝突的圖片會導致畫面閃爍和漂移。請為每個參考素材只分配一個職責,讓各個槽位互相獨立。
跳過迭代。 直接發布第一版渲染幾乎從來不是正確的選擇。每次迭代只改一個變數,把 2K 主版本渲染留給最終真正要發布的那一版。
把音訊當作事後考慮。 靜音或配樂糟糕的片段會在預設開聲自動播放的平台上流失留存。要麼使用 MiniMax H3 的管線內音訊,要麼有意地與 MiniMax Audio 搭配。音訊不是後期步驟。
MiniMax H3 爆紅影片常見問題
單條 MiniMax H3 片段可以多長?
MiniMax H3 生成的片段處於與 Reels、TikTok 和 Shorts 匹配的短影片時長範圍內。用於爆紅目的時,建議把工作時長規劃在 15 秒左右,再為限時動態和純鉤子剪輯切到 6 到 12 秒。對於更長的敘事,請生成多個鏡頭並把它們剪輯在一起,而不是把長故事硬塞進一次生成。
MiniMax H3 能輸出直式影片嗎?
可以。MiniMax H3 支援 9:16、1:1、3:4、4:3、16:9 和 21:9。在 TikTok、Reels 和 Shorts 上做原生短影片投放時,請從第一版渲染就用 9:16,而不是從更寬的主版本裁切。
MiniMax H3 輸出裡有聲音嗎?
有。MiniMax H3 在生成畫面的同一次任務中生成同步的立體聲音訊,包括對白、環境音和音效。對於需要獨立旁白、音樂或對口型對白的創作者,MiniMax Audio 可以作為互補的人聲與音樂模型與 MiniMax H3 搭配。
如何在多條片段裡維持同一個角色?
用一張參考圖鎖定角色身份,並在系列裡的每次生成中都重複使用同一個參考。為每個參考素材只分配一個職責:一張圖定身份、另一張定服裝、一段影片定動作、一段音訊定聲音。完整方法見我們的角色一致性詳解。MiniMax H3 角色一致性指南
一條 MiniMax H3 爆紅片段要多少錢?
計費採用量計價,按輸出秒數計費。原生 2K 下為每秒 0.13 美元,因此一條 15 秒片段約 1.95 美元。768P 下為每秒 0.09 美元,因此一條 15 秒片段約 1.35 美元。用 768P 迭代、把 2K 留給最終主版本,是標準的成本控制做法。
MiniMax H3 有免費或入門選項嗎?
最快的零代碼路徑是 PixMind MiniMax H3 生成器,它帶有入門方案。我們的免費額度指南講解了如何領取並疊加額度,讓你在投入付費預算之前先驗證工作流程。MiniMax H3 免費額度指南
我可以在社群平台上把 MiniMax H3 片段用於商業用途嗎?
MiniMax H3 的輸出適用於多數商業短影片用途,但人臉、品牌標誌、產品幾何形狀、螢幕文字和授權角色在發布前都需要做最終的權利與準確性審核。請確保你對自己餵入模型的真實人物或第三方參考素材擁有相應權利。
結論:先把循環跑起來,再慢慢打磨
把 MiniMax H3 做成爆紅片段的創作者,並不是那些寫出最長提示詞的人。他們是那些把六步循環跑得很緊湊的人:把別的事都先放一邊先把鉤子定下來、寫一份 15 秒節拍腳本、按職責鎖定參考素材、做迭代渲染、用 MiniMax Audio 搭配音和聲音、再加字幕做直式匯出,瞄準循環本身。這個循環跑一遍就得到一條片段;每週用鎖定的參考素材跑,就得到一個系列。
下一步:開啟 PixMind MiniMax H3 生成器,從上面的七套提示詞範本裡挑一套,鎖定一個角色參考,今天就渲染出你的第一條 15 秒片段。明天再用同樣的參考素材跑一遍。開啟 MiniMax H3 影片生成器 瀏覽所有已串接的 AI 影片模型
本指南中的規格、定價與功能於 2026-08-01 對照 MiniMax 官方平台和 MiniMax H3 模型卡片進行了核實。社群與創作者趨勢的引用均為泛指;模型卡片和費率表變化很快,請在正式產出前在你所用通路裡確認即時數值。



