德國 AI 公司 Black Forest Labs(BFL)於 8 月 5 日宣佈,其最新影片生成模型 FLUX 3 Video 已正式面向公眾開放,使用者可通過 BFL API 及部分合作夥伴使用。該模型支援生成最長 20 秒的 HD 或 Full HD 影片,並原生包含音訊,涵蓋對話、音效與環境噪聲,同時支援文生影片、圖生影片、關鍵幀控制、影片續寫,以及單片段內的多場景與多機位切換。

FLUX 3 Video 的一大亮點是能夠在場景中直接渲染文字,並能遵循複雜提示詞,藉助世界知識生成內容,適用於紀錄片等場景。此外,模型支援超過 14 種語言的唇形同步對話,進一步拓展了其在多語言內容創作中的應用。

在效能方面,BFL 公佈的自測 Elo 排名顯示,FLUX 3 Video 在文生影片類別中以 1135 分位居榜首,在圖生影片類別中以 1051 分同樣排名第一,領先於 Gemini Omni Flash、Minimax H3 與 Seedance 2.0 等競品。不過,這些排名來自 BFL 自身的測試,其客觀性有待第三方驗證。

定價方面,FLUX 3 Video 按影片輸出時長計費,音訊包含在內。草稿模式(Draft mode)僅支援 HD 解析度,文生影片或圖生影片每秒 0.06 美元,影片生影片(video-to-video)每秒 0.12 美元。全質量模式下,HD 解析度文生影片或圖生影片每秒 0.17 美元,影片生影片每秒 0.41 美元;Full HD 解析度則分別為每秒 0.29 美元與 0.53 美元。

BFL 此前以影像生成模型 FLUX 系列聞名,此次進軍影片生成領域,直接對標 Runway、Pika 以及字節跳動的 Seedance 等產品。其宣稱的 Elo 排名優勢,若經得起第三方評測,可能對現有影片生成市場的競爭格局產生衝擊。對於 AI 影片創作者而言,FLUX 3 Video 的原生音訊與多語言唇形同步功能,有望降低後期製作成本,而按秒計費的靈活定價模式,也為不同預算的使用者提供了選擇空間。

不過,BFL 的 Elo 排名基於自家測試,其評測標準與樣本是否公允尚不明朗。行業觀察者認為,影片生成模型的競爭已從單純畫質比拼,轉向音訊、多語言支援與可控性等綜合能力的較量。FLUX 3 Video 的正式釋出,標誌著這一賽道進入新的競爭階段,後續市場反應與第三方評測結果值得關注。