🔥MiniMax H3 official 50% off|Annual membership includes unlimited H3 access Get 30% off annual membership Offer ends Aug 15Upgrade now
Pixmind

PixVerse 影片生成器評測與 V6 完整指南

文章目錄

PixVerse 影片生成器評測與 V6 完整指南

這篇 pixverse-video-generator 評測涵蓋 PixVerse V6,也就是 AIsphere 於 2026 年 3 月 30 日推出的目前旗艦版本(PixVerse 部落格, 2026)。V6 提供原生 1080p 片段、單次生成的原生音訊、多語言的畫面內文字,以及 20 多種電影級攝影機控制。它是目前的主力模型,不是被淘汰的舊版。

先說明立場:本評測是根據 PixVerse 官方文件,以及 Reddit 和 Trustpilot 上的社群測試所撰寫。PixMind 並未親自跑這些片段。母公司 AIsphere 於 2023 年在北京成立,創辦人王長虎曾任字節跳動電腦視覺負責人。2026 年 7 月的 C 輪募資讓總資金來到 4.39 億美元,估值超過 20 億美元(TechCrunch, 2026)。AIsphere 目前總部設於新加坡。

重點摘要

  • PixVerse V6 是目前的旗艦版本(2026 年 3 月 30 日);C1 是電影級的兄弟模型,並非替代品。
  • AIsphere 總資金於 2026 年 7 月達到 4.39 億美元,估值超過 20 億美元(TechCrunch, 2026)。
  • V6 含音訊的 1080p 每秒成本 23 點數,因此一段 5 秒片段在基本費率下約為 23 美元。
  • V2.x 已於 2026 年棄用。任何以 V2.x 為基礎的教學都應視為過時。

在 PixMind 上開啟 PixVerse 工具

PixVerse 是什麼?

PixVerse 是 AIsphere 旗下的 AI 影片產品線,中文全名為「北京愛詩科技」(Beijing Aishi Technology)。王長虎與 Jaden Xie 於 2023 年在北京創辦該公司,目前已遷至新加坡(TechCrunch, 2026)。王長虎在字節跳動累積的電腦視覺背景,反映在 PixVerse 對動作連貫性與角色一致性的強項上。

模型陣線從 V2(2024 年 7 月)開始,依序為 V2.5、V3.5、V4(2025 年 2 月)、V4.5、V5、V5.5、V5.6,到 V6(2026 年 3 月 30 日,目前旗艦)。C1(2026 年 4 月 7 日)是電影級兄弟模型,並非替代品。R1 則為即時等級(2026 年 1 月)。V2.x 已於 2026 年棄用,因此任何以 V2.x 輸出為基礎的教學都已過時。

[圖表:PixVerse 模型譜系時間軸 — V2(2024 年 7 月)、V2.5、V3.5、V4(2025 年 2 月)、V4.5、V5、V5.5、V5.6、V6(2026 年 3 月 30 日,目前旗艦)、C1(2026 年 4 月 7 日,電影級兄弟模型)、R1(2026 年 1 月,即時)— 來源:pixverse.ai/blogs 與 PR Newswire]

[獨家觀點] 「目前版本」這個狀態在此比平常更重要。Midjourney、Veo 和 Imagen 在 2026 年都經歷過版本交接,舊版不是失去 API 存取,就是被重新導向。PixVerse V6 沒有發生這種事。你今天開始一個專案,頭上不會掛著遷移期限,這在 2026 年的版本中相當罕見。

原廠宣稱在 175 個國家擁有超過 1 億名創作者。請將這個數字視為自述的行銷數據,而非獨立稽核的結果。4.39 億美元的總資金與超過 20 億美元的估值,給予 PixVerse 多數中國創辦 AI 影片新創所缺乏的財務跑道(TechCrunch, 2026)。

把參考片段轉成可重用的提示詞

PixVerse 影片生成器:核心功能

V6 的主打功能從原生 1080p 輸出與 1 到 15 秒片段開始。它能從單一提示詞產出多鏡頭短片,並且一次生成原生音訊(PixVerse 部落格, 2026)。模型還內建 20 多種電影級攝影機控制、多語言畫面內文字,以及用於多圖參考的 Character Lock。

從單一提示詞產出多鏡頭短片

V6 可以把單一提示詞裡的鏡頭串成一部短片。舊版 PixVerse 每個提示詞只能生成一段片段。V6 會自己規劃鏡頭之間的剪接,這對分鏡腳本、廣告片段與社群短影音相當重要。

Reddit 使用者反映,V6 的多鏡頭一致性比兄弟模型 C1 弱(reddit.com/r/PixVerse, 2026)。C1 是為電影級連貫性而調校,V6 則是為控制廣度而調校。請選擇符合工作負載的模型。

原生音訊與 20 多種攝影機控制

原生音訊會在一次生成中同時產生音訊與影片。這省去對話、環境音與音效的後配音步驟。Reddit r/PixVerse 討論串形容音訊「粗糙,需要多次嘗試」,所以請準備好反覆重生成,直到聲音到位。

20 多種攝影機控制涵蓋推軌、平移、俯仰、變焦、軌道、搖臂與焦點轉移。你可以在一個提示詞裡串接多個運鏡,這正是 V6 領先那些每段片段只開放單一運鏡的競爭對手之處。

Character Lock 與多語言文字

Character Lock 讓你輸入同一個拍攝對象的多張參考圖。V6 會在鏡頭之間維持臉部與服裝一致,這是廣告公司與短片創作者最先上手的功能。多語言畫面內文字支援英文、中文與其他主要文字系統,對海報與廣告作業非常重要。

Cinematic shot, 1080p, 5 seconds: woman in red jacket walks through neon-lit
Tokyo alley at night, rain on pavement, dolly-in from medium to close-up,
ambient rain audio, in-frame neon sign reads "OPEN 24 HRS",
Character Lock reference: character_ref_01.png

[親身經驗] 根據我們為 PixMind 工作流程評測 AI 影片工具的經驗,單一提示詞多鏡頭是你信任它處理客戶交付成果前,最值得壓力測試的功能。用同一個提示詞跑三次,數一數角色服裝在剪接之間維持一致的頻率,再做決定。

[圖片:兩段 PixVerse V6 1080p 片段的並排範例,展示 Character Lock 在同一個提示詞序列的兩個不同鏡頭中,維持拍攝對象的臉部與紅色外套一致。搜尋關鍵字:「pixverse v6 character lock multi-shot example」]

效果、範本與 CLI

V6 繼承 PixVerse 的效果與範本生態系,這是 2026 年 AI 影片領域較齊全的資源庫之一。CLI 與網頁介面同步推出,並相容於 Claude Code、Codex、Cursor 與 OpenClaw。如果你會架設從提示詞來源腳本化算圖工作的管線,這點相當重要。

規格:解析度、長度、長寬比

V6 原生輸出 1080p,並透過 Upscale 模式以每秒額外 5 點數升至 4K(docs.platform.pixverse.ai, 2026)。片段長度為 1 到 15 秒。長寬比涵蓋 9:16、16:9、1:1 與 21:9。影格率據報可達 30 FPS,但這個數字並未出現在官方文件中,而是來自社群測試。

規格 V6
原生解析度 1080p
最高解析度 透過 Upscale 達 4K(每秒 +5 點數)
片段長度 1 到 15 秒
長寬比 9:16、16:9、1:1、21:9
影格率 最高 30 FPS(未見於官方文件)
模式 Text-to-Video、Image-to-Video、Transition、Extend、Fusion

21:9 比例是廣告與預告作業的差異化優勢。多數 2026 年的影片模型只到 16:9。PixVerse 是少數原生提供變形寬螢幕輸出的廠商之一,這能省下後製時加上黑邊的步驟。

免費方案的片段會帶浮水印。付費方案會移除浮水印,但確切的浮水印政策細節並未見於官方文件,且消費者 App 與 API 之間可能有所不同。

PixVerse 影片生成器定價

定價採點數制,基本費率為 1 美元等於 5 點數(docs.platform.pixverse.ai, 2026)。V6 的 Text-to-Video 與 Image-to-Video 在 1080p、不含音訊的情況下為每秒 18 點數。加上原生音訊會提高到每秒 23 點數。以基本費率計算,一段 5 秒、含音訊的 V6 1080p 片段為 115 點數,約合 23 美元。

模式 解析度 音訊 每秒點數
V6 T2V / I2V 360p 5
V6 T2V / I2V 1080p 18
V6 T2V / I2V 1080p 23
C1 1080p 19
C1 1080p 24
Upscale 升至 4K 不適用 +5
SFX 附加 不適用 +2
Lip sync 附加 不適用 +4

[獨家觀點] 較舊的 V5 時代部落格文章引用「每部影片 0.30 到 0.45 美元」的數字,這在 V6 1080p 上並不成立。那個數字來自 360p、無音訊的輸出。V6 1080p 含音訊的誠實單片成本,5 秒接近 23 美元,而不是四十美分。如果你在教學中看到舊數字,那就是過時了。

API 會員方案能降低每段片段的實際成本。Essential 方案每月 100 美元,提供 15,000 點數。Scale 方案每月 1,500 美元,提供 239,230 點數。Business 方案每月 6,000 美元,提供 1,069,500 點數。隨用隨付套組從 10 美元換 1,000 點數,到 5,000 美元換 500,000 點數。

生成失敗仍會消耗點數。這在 V6 上是真實的成本負擔,特別是使用原生音訊時,因為粗糙的初次輸出意味著更多次重新生成。

[圖表:比較 V6 每秒成本的長條圖 — 360p 無音訊 5 點數、1080p 無音訊 18 點數、1080p 含音訊 23 點數、C1 含音訊 24 點數 — 來源:docs.platform.pixverse.ai]

如何免費使用 PixVerse

實際的存取路徑有三條。PixVerse 消費者 App(網址 pixverse.ai)提供附每日點數的免費方案。確切的每日點數配額隨目前 App 而定,且各來源數字不一致。請至 pixverse.ai 查看即時數字,而不要相信靜態部落格的說法。

第二條路徑是 PixMind 的封裝介面,位於 /pixverse-video。它透過瀏覽器 UI 開放 V6,無需設定 API。這是我們推薦給首次使用者、想在付費前先評估模型的路徑。

第三條路徑是 fal.ai,為想要 API 存取但不願加入 PixVerse 會員的開發者託管 V6。fal.ai 定價依照它自己的代幣機制,因此承諾前請先與官方點數費率比較。

免費方案的輸出會帶浮水印。付費方案會移除浮水印,且消費者 App 與 API 對浮水印政策的處理方式不同。在交付客戶成果前請規劃升級,因為帶浮水印的片段在多數商業情境下無法交付。

PixVerse 與其他 AI 影片模型的比較

目前沒有第一級基準測試,將 V6 與 Runway、Veo 3.1、Sora 2、Kling 3.0、Seedance 2.5 進行正面排名。請將下方比較視為質性觀察,取材自社群測試與競技場排名。請注意 Veo 3 API 已於 2026 年 6 月 30 日退役,因此任何 Veo 比較都必須使用 Veo 3.1。

對上 Runway:Runway 在明確的攝影機指令與關鍵影格級控制上較強。V6 在提示詞廣度,以及用一句話產出可用片段、所需的手動調整較少方面勝出。需要精準分鏡腳本時選 Runway;需要發想速度時選 V6。

對上 Veo 3.1:Veo 3.1 在電影級動態與寫實度上領先。V6 在價格,以及 Veo 原生不提供的 21:9 長寬比上競爭。Veo 僅限付費的門檻也把預算敏感的創作者推向 V6。

對上 Sora 2:Sora 2 在敘事寫實度上領先,但僅限付費且設有門檻。V6 在不需訂閱承諾就能測試方面更為可及,這對早期創意探索相當重要。

對上 Kling 3.0:Kling 在速度與較長格式片段上勝出。V6 在音訊整合與效果/範本生態系上勝出,在發文時間點上比 Kling 更成熟。

對上 Seedance 2.0 與 2.5:Seedance 在角色一致性上領先,在中國市場工作流程中表現強勁。V6 在電影級攝影機控制,以及中文以外的多語言畫面內文字上領先。

對上 PixVerse C1:根據 Reddit 測試,電影級兄弟模型 C1 在多鏡頭一致性上勝過 V6(reddit.com/r/PixVerse, 2026)。V6 則在控制廣度、原生音訊整合與效果生態系上勝過 C1。做電影級作業時,請兩者並排測試。

必須知道的限制

PixVerse 官方承認,複雜場景中的精確方向控制,以及跨重大空間變化的一致性,仍在不斷改進中(PixVerse 部落格, 2026)。這些是廠商自承的限制,不是社群臆測。

動態中的人臉,特別是說話的特寫鏡頭,仍具挑戰性。根據 Reddit r/PixVerse 討論串,原生音訊粗糙且需要多次嘗試。V6 的多鏡頭一致性比兄弟模型 C1 弱。生成失敗仍會消耗點數,這會在運氣不好時拉高實際成本。

訂閱帳單爭議出現在 Trustpilot 上(trustpilot.com, 2026)。抱怨集中在自動續約行為與退款處理。在承諾年度方案前請詳閱帳單條款,並在信任工作流程前優先選擇月繳。

[圖片:PixVerse V6 生成失敗案例的截圖,說話特寫產生了明顯的臉部扭曲,呈現官方自承、動態人臉上的限制。搜尋關鍵字:「pixverse v6 talking face distortion example」]

常見問題

PixVerse V6 是目前的模型嗎?

是的。V6 於 2026 年 3 月 30 日推出,是目前旗艦(PixVerse 部落格, 2026)。C1 於 2026 年 4 月 7 日推出,是電影級兄弟模型,並非替代品。V2.x 已於 2026 年棄用。目前尚未有 V7。

誰製作 PixVerse?

AIsphere 製作 PixVerse,中文全名為「北京愛詩科技」(Beijing Aishi Technology)。曾任字節跳動電腦視覺負責人的王長虎與 Jaden Xie 於 2023 年在北京創辦該公司,目前總部位於新加坡(TechCrunch, 2026)。

V6 片段要多少錢?

一段 5 秒、含原生音訊的 V6 1080p 片段成本為 115 點數,在 1 美元等於 5 點數的基本費率下約合 23 美元(docs.platform.pixverse.ai, 2026)。V5 時代部落格中「每部影片 0.30 到 0.45 美元」的舊數字,適用於 360p 無音訊輸出,不適用於 V6。

有免費方案嗎?

有的。PixVerse 消費者 App(網址 pixverse.ai)提供附每日點數的免費方案(pixverse.ai, 2026)。確切的每日配額隨目前 App 而定,各來源不盡相同。PixMind 的封裝介面(位於 /pixverse-video)也透過瀏覽器 UI 開放 V6。

什麼時候該改用 C1 而不是 V6?

當剪接之間的連貫性最重要時,請為電影級多鏡頭作業使用 C1。當你需要更廣的控制、原生音訊、20 多種攝影機運鏡,或效果與範本生態系時,請使用 V6。Reddit r/PixVerse 使用者建議用同一個提示詞同時跑兩個模型並比較(reddit.com/r/PixVerse, 2026)。

結論:PixVerse V6 是堅實的當前首選

PixVerse V6 是 2026 年當下的旗艦,沒有遷移期限,具備原生 1080p 輸出、從單一提示詞產出多鏡頭短片、原生音訊,以及 20 多種電影級攝影機控制。AIsphere 的譜系與 4.39 億美元總資金,讓它有足夠跑道走過下個模型週期。C1 則補上 V6 自承仍在演進的電影級多鏡頭情境。

對 pixverse-video-generator 搜尋的誠實框架是:V6 是今天正確的起點,但有兩個但書。生成失敗仍會消耗點數,因此在花錢做含音訊的 1080p 之前,請先用 360p 測試片段。而且原生音訊粗糙到需要重新生成,這會使成本疊加。

對首次使用者,PixMind 封裝介面是最簡單的路徑。對開發者,fal.ai 託管了具備 API 存取的 V6。對高量作業,Essential 或 Scale 會員方案相較於隨用隨付,能顯著降低每段片段的實際成本。

在 PixMind 上開啟 PixVerse 工具

在生成前先打造更精準的提示詞

继续浏览中,生成器即将加载...