最新多鏡頭序列已上線 —— 一個提示即可生成多個鏡頭剪輯

用提示詞、圖片或兩張關鍵影格生成 FLUX 3 影片

flux3 端到端運行 Black Forest Labs 的影片模型——從文字到影片、從圖片到影片、參考驅動鏡頭、關鍵影格與多鏡頭序列,並在同一次生成中產出配樂。於下方輸入提示詞,你的片段數分鐘內即可回傳。

試試這些提示詞

免安裝、免候補名單 · 影像同步生成聲音 · 以點數付費,不需訂閱

模型
FLUX 3 Video
開發者
Black Forest Labs
音訊
模型內生成
開放權重
FLUX 3 Dev 即將推出

獨立平台

flux3-video.net 是一個獨立的生成平台。我們與 Black Forest Labs 並無任何隸屬、背書或贊助關係;「FLUX」為其權利人之商標,本文僅作描述性使用。

生成模式

用 FLUX 3 生成一段影片的五種方式

每種模式需要不同的輸入,解決的問題也不同。選擇最符合你手上素材的模式——一句話、一張照片、一份角色參考,或兩張影格。

01

只用一句話就能開始

FLUX 3 文字轉影片懂得鏡頭語言——焦段、運鏡方向、一天中的時間——所以只要提示詞把鏡頭寫清楚,就能得到相對應的鏡頭,而不是每個模型都愛預設的那種緩慢推近。

  • 長提示詞撐得住;細節在 200 字以上仍然持續帶來回報
  • 相同提示詞與種子會回傳相同鏡頭,方便你逐字微調迭代
生成文字轉影片片段
文字轉影片結果

prompt · 手持 35mm,跟拍一名快遞穿過被雨水浸透的夜市,霓虹倒映在水窪裡;她轉過街角時,鏡頭向左漂移。

模式
text-to-video
比例
16:9
02

把你已有的靜態畫面動起來

FLUX 3 圖像轉影片會保留來源影格的身分特徵、光線與顆粒感,而不是把你的主體重新渲染成「看起來很像但不是同一個」——這正是做產品照、形象照或藝術作品時的關鍵。

  • 上傳影格,只描述動作——影像本身就會帶出風格
  • 臉部與 Logo 能完整撐住整段影片,不會第一秒後就融掉
上傳圖片並讓它動起來
圖像轉影片結果

prompt · 來源:棚拍人像,85mm。動作:主角呼出一口氣,轉向鏡頭,頭髮慢慢落定。

模式
image-to-video
輸入
1 張靜態影格
03

跨片段保持同一個角色

FLUX 3 參考圖像式影片生成會讀取人物、產品或場景的圖片,並把它們帶進新的鏡頭中,讓一系列畫面看起來像同一天拍完,而不是從陌生素材拼湊出來。

  • 角色、服裝與場景參考可在同一次生成中一起使用
  • 一致性可跨多次生成維持,不只侷限於單一片段內
用參考圖片生成
參考表 + 結果

prompt · 參考:[角色參考表]、[外套]。同一名角色走進貨運電梯,頭頂是日光燈,電梯門在鏡頭中闔上。

模式
reference
輸入
2 張圖片
04

釘住第一與最後一格

提供 FLUX 3 關鍵影格影片一張起始圖與一張結束圖,它會解出中間的動作——適合做能無縫剪進既有素材的片段,或是能完美循環、不露接縫的 loop。

  • 兩端影格會原封不動回來;只有中間畫面由模型生成
  • 兩端使用同一張圖片即可得到完美循環
在兩個關鍵影格之間生成
起始影格 → 結束影格

prompt · 起始:清晨的空餐館卡座。結束:同一個卡座,咖啡已倒好,陽光更高。慢慢漂移,鏡頭不移動。

模式
keyframe
輸入
起始 + 結束
05

拿到的是整個場景,而不只是一個鏡頭

FLUX 3 多鏡頭影片生成會一次回傳多個剪接段落,且共享同一主體與場景;因此 15 秒的故事節拍可以一鍵生成,不必拆成四段片、再花一個下午進剪輯軟體拼接。

  • 在提示詞中描述分鏡,模型就會依照你說的地方切鏡
  • 主體與光線能跨鏡頭保持一致,不用手動硬拼
生成多鏡頭序列
多鏡頭序列

prompt · 鏡頭 1:遠景,濃霧中的燈塔。鏡頭 2:特寫,雙手轉動機械。鏡頭 3:從燈室往下看海面。

模式
multi-shot
鏡頭數
3
聲音

你的片段會自帶音軌一同生成

聲音會隨著畫面幀一起生成,而不是事後加上去——因此即使模型決定把門關上,也會在正確的那一幀聽到門閂喀噠一聲。

環境音、擬音與對白一次到位

FLUX 3 影片原生音訊讓你在初剪時無需另做音效設計。用提示詞描述混音,就像你會怎麼交代剪輯師——「鐵皮屋頂上的雨聲,不要音樂」——回來的就是那樣。

無縫延長片段

FLUX 3 影片與音訊延長能把完成的生成內容延伸到結尾之後,讓畫面與空間底噪一併往前承接。當片段需要比單次生成更長時,可以串接多次延長。

音訊範例——請開啟聲音播放

一次生成,未額外加入任何後期音效設計。

prompt · 夜晚的工坊:刨刀刮過木頭,木屑落下,遠處車流聲,隔壁房間的收音機。不要音樂。

音訊
模型內生成
後製
運作方式

從提示到成片,只要三步

免安裝、免節點圖、免候補名單。本頁上方的生成器就是完整工作流程。

  1. 01

    描述鏡頭

    輸入提示詞,或依你想要的模式拖曳圖片、參考集或關鍵影格。若想從已驗證好用的設定開始,提示詞預設一鍵就能套用。

  2. 02

    設定比例、長度與聲音

    選擇 16:9、9:16 或正方形,設定片段長度與解析度,並決定是否隨畫面一併生成音訊。提交前會即時更新所需點數。

  3. 03

    生成並下載

    片段會在背景渲染,你可繼續其他工作。下載、延長,或再送回「圖轉影片」進行下一次生成——所有內容都會保留在你的作品中。

未登入的訪客可以撰寫提示並查看成本;要生成需要帳號。

提示詞庫

有效的提示詞,以及它們產出的結果

以完全相同的提示詞與設定公開的真實生成作品,方便你直接複製一份、改一個字,就能看出哪些地方會跟著動。這裡沒有任何事後評分、重剪或聲音設計。

提示撰寫筆記

  1. 01指名攝影機:焦段、運鏡與速度對畫面影響,比形容詞更大
  2. 02若聲音很重要,就要明確描述——「安靜」也是有效指令
  3. 03每次只改一個變因;種子加提示詞可重現結果
物理示例
模式
text-to-video

重量與接觸

提示詞

布料、灰塵與撞擊——讓物理一次就到位的提示詞寫法。

prompt · 一塊厚重的帆布篷布被一口氣從機車上拉下來,灰塵在光中被照亮,篷布撞上混凝土時摺疊起來。

一致性示例
模式
reference

同一角色,五個場景

提示詞

重用同一組參考資料,做出系列作品,而不是一次性的單張生成。

prompt · 參考資料:[角色設定表]。五個場景,同一主體與服裝,不同光線。

文字渲染示例
模式
text-to-video

畫面內文字清晰可讀

提示詞

招牌與包裝在渲染後仍能辨識——FLUX 一向擅長的項目,現在也能動起來。

prompt · 鏡頭緩慢推近一扇手繪窗戶,上面寫著「CLOSED FOR THE SEASON」,街景倒影在玻璃上滑動。

音畫同步示例
音訊
in-model

聲音與動作精準同步

提示詞

四次敲擊、四次火花、四聲鏗鏘——如何提示音訊精準落在畫格上。

prompt · 一名鐵匠敲打燒紅的金屬四次,每次敲擊都噴出火花,最後以淬火收尾並發出嘶嘶聲。

媒體欄位已接好並等待填入——把匯出的片段放進 /public/showcase,並在 src/i18n/pages/index/en.json 裡補上路徑。

比較

FLUX 3 Video 與 Veo 3、Kling AI、Runway 及 Sora 2 的對比

同樣的提示詞、五個模型。聚焦真正會改變你工作流程的差異,而不是只影響跑分的數字。

能力FLUX 3 VideoVeo 3Kling AIRunway Gen-4.5Sora 2
基於參考的風格一致性部分部分
起始+結束關鍵影格
單一提示詞生成多鏡頭部分部分
原生音訊部分
帶音訊延長片段部分部分
已宣布開放權重預期會有 Dev 版

FLUX 3 Video vs Veo 3

兩者都能替畫面配上聲音,因此勝負取決於控制力。Veo 3 更擅長單一鏡頭的電影感;FLUX 3 則提供參考與關鍵影格,當片段必須與既有內容對齊時,這正是你需要的。

聽聽原生音訊生成

FLUX 3 Video vs Kling AI

Kling 一直是影像轉影片與起/迄畫格的可靠主力。FLUX 3 在控制力上不相上下,並在音訊與多鏡頭序列上領先——而這些往往才是最耗剪輯時間的地方。

看看 FLUX 3 的影像轉影片模式

FLUX 3 Video vs Runway Gen-4.5

Runway Gen-4.5 深度整合在剪輯套件中,而其中一半的價值正來自這種情境。FLUX 3 則是你可以透過提示詞輸入框或 API 來驅動的模型;如果你的時間軸早已在其他地方,這會更快。

了解 FLUX 3 Video API

FLUX 3 Video vs Sora 2

Sora 2 在長篇敘事一致性上樹立了標竿。FLUX 3 的回應是逐鏡頭控制加上一次生成多鏡頭——而且如果 Dev 分支能延續以往 FLUX 的風格,還可能提供你可自行運行的權重。

查看多鏡頭生成
存取、API 與價格

今日可用的生成方式,以及模型的發展方向

你現在就能做什麼,以及 Black Forest Labs 已公告與尚未公告的內容。

現已提供

如何取得 FLUX 3 Video 的使用權限

在這裡建立帳號即可開始生成——不需要邀請碼、不用排候補名單、也不必在本機安裝。對於想要產出結果、而不是在佇列裡等位置的人來說,這是最快的途徑。

僅限邀請

FLUX 3 Video 搶先體驗(Early Access)

Black Forest Labs 自家的搶先體驗計畫採邀請制,且使用額度上限較低。在那裡申請、同時在這裡生成並不互斥——大多數人會兩邊都做。

按片段計費

FLUX 3 Video 定價

以點數計費,而非訂閱制。費用會隨片段長度、解析度,以及是否生成音訊而調整;在你按下生成前就會顯示確切價格——不會有意外的計量費用。

已提供

FLUX 3 Video API

可在你自己的流程中驅動相同的生成模式:提交工作、輪詢狀態、取回成品。當影片生成只是大型產品中的一個步驟,而非整個任務本身時,特別實用。

尚未公布

FLUX 3 Dev 發布日期

目前尚無任何官方消息。先前的 FLUX 世代通常會在託管版本穩定後推出 Dev 變體,因此可預期的節奏是數週到數個月——這是過往案例,不是承諾。

預期會有

FLUX 3 Dev 會開源嗎?

以往每次 Dev 發布都會提供可下載的權重,並採非商業授權——屬於開放權重,而非 OSI 定義的開源。影片模型也更為龐大,若你打算自行託管,請準備足夠且可觀的 VRAM。

常見問題

在你開始生成之前的問題

在本頁上方的生成器輸入提示詞,或依模式上傳圖片、參考集或關鍵影格。選擇畫面比例、長度,以及是否生成音效,然後按下「生成」。片段會在背景渲染並出現在你的作品中,你可以下載、延長,或再送回以圖生影再跑一輪。不用安裝,也沒有候補名單——只需要一個帳號。

生成以點數計費,而非月訂閱制;單支片段的成本會隨片長、解析度,以及是否同時生成音訊而變動。確切所需點數會在你按下「生成」前顯示,因此不會在你不知情的情況下暗中計量;未使用的點數也不會像訂閱額度那樣在結帳月結束時到期。目前費率請見定價頁面。

從你手上已經有的素材開始:只有一句話、沒有其他素材,就用文字轉影片;有一張既有的靜態圖,且希望完全保持原樣,就用圖片轉影片;需要同一個角色或產品出現在多段片子裡,就用參考式生成;需要在特定起始與結束影格對齊的鏡頭——例如循環,或接到你已剪好的素材——就用關鍵影格。當同一個節奏點需要多個切鏡時,多鏡頭生成會從同一個提示詞一次回傳多段鏡頭。

是的。環境音、擬音與對白會與影格在同一次生成中完成,而不是事後再疊上去;因此聲音事件會與模型自己「想出來」的動作對齊,而不只對齊你描述的動作。你也可以在提示詞中指導混音——例如要求「下雨且不要音樂」,就會得到下雨且沒有音樂的結果。片段也能在畫面與聲音一起延長,讓較長的剪輯不會在銜接處明顯露出接縫。

有 API,可從你自己的流程中驅動相同的生成模式:提交任務、輪詢狀態、取回資產。關於使用權:在付費方案下生成的片段,你可以用於客戶案、廣告與社群內容——具體措辭請以服務條款為準;另外也請注意,這與 FLUX 3 Dev 權重的授權問題是分開的,FLUX 3 Dev 預期會像先前的 FLUX Dev 版本一樣以非商業授權釋出。

Black Forest Labs 尚未公布 FLUX 3 Dev 的發布日期。依先前 FLUX 世代的慣例,Dev 變體通常會在託管模型推出後數週到數月內發布,並以非商業授權提供可下載的權重——是開放權重,但不是 OSI 定義下的開源。影片模型比圖像模型龐大得多,因此自架所需的 VRAM 會遠高於過去執行 FLUX 圖像權重的需求。

生成你的第一支 FLUX 3 影片片段

一個提示詞,含音效,幾分鐘就完成。只有在你按下「生成」時才會扣除點數。