Black Forest Labs 多模態影片

FLUX 3

Black Forest Labs 多模態影片模型,可從文字生成同步音訊。

適合做什麼

用 FLUX 3 導演完整視聽場景

從文字、連續圖片或現有片段出發,產生連貫的 720p 或 1080p 影片,並同步對白、環境聲與音效。

使用 FLUX 3 創作

敘事預覽

在正式製作前,用畫面與同步聲音搭完整場景。

分鏡動畫

把已批准的分鏡幀串成連貫的視覺序列。

鏡頭延展

在保持視覺方向的前提下,延續一次成功的生成。

核心能力

創作者為何選擇 FLUX 3

01

畫面與聲音一次生成

在一則提示詞裡描述動作、鏡頭運動、對白、環境聲與特效。FLUX 3 在同一次生成中合成動態畫面與同步音軌。

A home video of a futuristic San Francisco with people riding hoverboards.
02

鏡頭內運動保持連貫

在 5 到 20 秒的片段中構建有氛圍的場景——鏡頭運動、主體動作與環境細節都更穩定。

03

分鏡或續拍已有鏡頭

用一張圖作開場幀、兩張作首尾幀、最多十張作定時分鏡,或以 MP4 為起點續拍後續內容。

如何獲得更好的效果

提升效果的技巧

先寫清主體,再補充光影、風格,以及必須保持不變的內容。需要更可控的編輯時,上傳參考圖。

  1. 1

    把聲音寫進提示詞

    當音訊很重要時,請明確寫出對白、房間底噪、音樂與音效。

  2. 2

    3 張以上圖片需設時長

    分鏡輸入必須指定時長,幀才能可預期地分配。

  3. 3

    1080p 前先 Draft

    用 Draft 驗證節奏與構圖,再以全品質渲染成片。

用 FLUX 3 把下一個創意變成影片

返回上方的工作區,或瀏覽完整模型目錄後再開始。