只用一句話就能開始
FLUX 3 文字轉影片懂得鏡頭語言——焦段、運鏡方向、一天中的時間——所以只要提示詞把鏡頭寫清楚,就能得到相對應的鏡頭,而不是每個模型都愛預設的那種緩慢推近。
- 長提示詞撐得住;細節在 200 字以上仍然持續帶來回報
- 相同提示詞與種子會回傳相同鏡頭,方便你逐字微調迭代
prompt · 手持 35mm,跟拍一名快遞穿過被雨水浸透的夜市,霓虹倒映在水窪裡;她轉過街角時,鏡頭向左漂移。
- 模式
- text-to-video
- 比例
- 16:9
flux3 端到端運行 Black Forest Labs 的影片模型——從文字到影片、從圖片到影片、參考驅動鏡頭、關鍵影格與多鏡頭序列,並在同一次生成中產出配樂。於下方輸入提示詞,你的片段數分鐘內即可回傳。
flux3-video.net 是一個獨立的生成平台。我們與 Black Forest Labs 並無任何隸屬、背書或贊助關係;「FLUX」為其權利人之商標,本文僅作描述性使用。
每種模式需要不同的輸入,解決的問題也不同。選擇最符合你手上素材的模式——一句話、一張照片、一份角色參考,或兩張影格。
FLUX 3 文字轉影片懂得鏡頭語言——焦段、運鏡方向、一天中的時間——所以只要提示詞把鏡頭寫清楚,就能得到相對應的鏡頭,而不是每個模型都愛預設的那種緩慢推近。
prompt · 手持 35mm,跟拍一名快遞穿過被雨水浸透的夜市,霓虹倒映在水窪裡;她轉過街角時,鏡頭向左漂移。
FLUX 3 圖像轉影片會保留來源影格的身分特徵、光線與顆粒感,而不是把你的主體重新渲染成「看起來很像但不是同一個」——這正是做產品照、形象照或藝術作品時的關鍵。
prompt · 來源:棚拍人像,85mm。動作:主角呼出一口氣,轉向鏡頭,頭髮慢慢落定。
FLUX 3 參考圖像式影片生成會讀取人物、產品或場景的圖片,並把它們帶進新的鏡頭中,讓一系列畫面看起來像同一天拍完,而不是從陌生素材拼湊出來。
prompt · 參考:[角色參考表]、[外套]。同一名角色走進貨運電梯,頭頂是日光燈,電梯門在鏡頭中闔上。
提供 FLUX 3 關鍵影格影片一張起始圖與一張結束圖,它會解出中間的動作——適合做能無縫剪進既有素材的片段,或是能完美循環、不露接縫的 loop。
prompt · 起始:清晨的空餐館卡座。結束:同一個卡座,咖啡已倒好,陽光更高。慢慢漂移,鏡頭不移動。
FLUX 3 多鏡頭影片生成會一次回傳多個剪接段落,且共享同一主體與場景;因此 15 秒的故事節拍可以一鍵生成,不必拆成四段片、再花一個下午進剪輯軟體拼接。
prompt · 鏡頭 1:遠景,濃霧中的燈塔。鏡頭 2:特寫,雙手轉動機械。鏡頭 3:從燈室往下看海面。
聲音會隨著畫面幀一起生成,而不是事後加上去——因此即使模型決定把門關上,也會在正確的那一幀聽到門閂喀噠一聲。
FLUX 3 影片原生音訊讓你在初剪時無需另做音效設計。用提示詞描述混音,就像你會怎麼交代剪輯師——「鐵皮屋頂上的雨聲,不要音樂」——回來的就是那樣。
FLUX 3 影片與音訊延長能把完成的生成內容延伸到結尾之後,讓畫面與空間底噪一併往前承接。當片段需要比單次生成更長時,可以串接多次延長。
一次生成,未額外加入任何後期音效設計。
prompt · 夜晚的工坊:刨刀刮過木頭,木屑落下,遠處車流聲,隔壁房間的收音機。不要音樂。
免安裝、免節點圖、免候補名單。本頁上方的生成器就是完整工作流程。
輸入提示詞,或依你想要的模式拖曳圖片、參考集或關鍵影格。若想從已驗證好用的設定開始,提示詞預設一鍵就能套用。
選擇 16:9、9:16 或正方形,設定片段長度與解析度,並決定是否隨畫面一併生成音訊。提交前會即時更新所需點數。
片段會在背景渲染,你可繼續其他工作。下載、延長,或再送回「圖轉影片」進行下一次生成——所有內容都會保留在你的作品中。
未登入的訪客可以撰寫提示並查看成本;要生成需要帳號。
以完全相同的提示詞與設定公開的真實生成作品,方便你直接複製一份、改一個字,就能看出哪些地方會跟著動。這裡沒有任何事後評分、重剪或聲音設計。
布料、灰塵與撞擊——讓物理一次就到位的提示詞寫法。
prompt · 一塊厚重的帆布篷布被一口氣從機車上拉下來,灰塵在光中被照亮,篷布撞上混凝土時摺疊起來。
重用同一組參考資料,做出系列作品,而不是一次性的單張生成。
prompt · 參考資料:[角色設定表]。五個場景,同一主體與服裝,不同光線。
招牌與包裝在渲染後仍能辨識——FLUX 一向擅長的項目,現在也能動起來。
prompt · 鏡頭緩慢推近一扇手繪窗戶,上面寫著「CLOSED FOR THE SEASON」,街景倒影在玻璃上滑動。
四次敲擊、四次火花、四聲鏗鏘——如何提示音訊精準落在畫格上。
prompt · 一名鐵匠敲打燒紅的金屬四次,每次敲擊都噴出火花,最後以淬火收尾並發出嘶嘶聲。
媒體欄位已接好並等待填入——把匯出的片段放進 /public/showcase,並在 src/i18n/pages/index/en.json 裡補上路徑。
同樣的提示詞、五個模型。聚焦真正會改變你工作流程的差異,而不是只影響跑分的數字。
| 能力 | FLUX 3 Video | Veo 3 | Kling AI | Runway Gen-4.5 | Sora 2 |
|---|---|---|---|---|---|
| 基於參考的風格一致性 | 部分 | 部分 | |||
| 起始+結束關鍵影格 | |||||
| 單一提示詞生成多鏡頭 | 部分 | 部分 | |||
| 原生音訊 | 部分 | ||||
| 帶音訊延長片段 | 部分 | 部分 | |||
| 已宣布開放權重 | 預期會有 Dev 版 |
兩者都能替畫面配上聲音,因此勝負取決於控制力。Veo 3 更擅長單一鏡頭的電影感;FLUX 3 則提供參考與關鍵影格,當片段必須與既有內容對齊時,這正是你需要的。
聽聽原生音訊生成Kling 一直是影像轉影片與起/迄畫格的可靠主力。FLUX 3 在控制力上不相上下,並在音訊與多鏡頭序列上領先——而這些往往才是最耗剪輯時間的地方。
看看 FLUX 3 的影像轉影片模式Runway Gen-4.5 深度整合在剪輯套件中,而其中一半的價值正來自這種情境。FLUX 3 則是你可以透過提示詞輸入框或 API 來驅動的模型;如果你的時間軸早已在其他地方,這會更快。
了解 FLUX 3 Video APISora 2 在長篇敘事一致性上樹立了標竿。FLUX 3 的回應是逐鏡頭控制加上一次生成多鏡頭——而且如果 Dev 分支能延續以往 FLUX 的風格,還可能提供你可自行運行的權重。
查看多鏡頭生成你現在就能做什麼,以及 Black Forest Labs 已公告與尚未公告的內容。
在這裡建立帳號即可開始生成——不需要邀請碼、不用排候補名單、也不必在本機安裝。對於想要產出結果、而不是在佇列裡等位置的人來說,這是最快的途徑。
Black Forest Labs 自家的搶先體驗計畫採邀請制,且使用額度上限較低。在那裡申請、同時在這裡生成並不互斥——大多數人會兩邊都做。
以點數計費,而非訂閱制。費用會隨片段長度、解析度,以及是否生成音訊而調整;在你按下生成前就會顯示確切價格——不會有意外的計量費用。
可在你自己的流程中驅動相同的生成模式:提交工作、輪詢狀態、取回成品。當影片生成只是大型產品中的一個步驟,而非整個任務本身時,特別實用。
目前尚無任何官方消息。先前的 FLUX 世代通常會在託管版本穩定後推出 Dev 變體,因此可預期的節奏是數週到數個月——這是過往案例,不是承諾。
以往每次 Dev 發布都會提供可下載的權重,並採非商業授權——屬於開放權重,而非 OSI 定義的開源。影片模型也更為龐大,若你打算自行託管,請準備足夠且可觀的 VRAM。
在本頁上方的生成器輸入提示詞,或依模式上傳圖片、參考集或關鍵影格。選擇畫面比例、長度,以及是否生成音效,然後按下「生成」。片段會在背景渲染並出現在你的作品中,你可以下載、延長,或再送回以圖生影再跑一輪。不用安裝,也沒有候補名單——只需要一個帳號。
生成以點數計費,而非月訂閱制;單支片段的成本會隨片長、解析度,以及是否同時生成音訊而變動。確切所需點數會在你按下「生成」前顯示,因此不會在你不知情的情況下暗中計量;未使用的點數也不會像訂閱額度那樣在結帳月結束時到期。目前費率請見定價頁面。
從你手上已經有的素材開始:只有一句話、沒有其他素材,就用文字轉影片;有一張既有的靜態圖,且希望完全保持原樣,就用圖片轉影片;需要同一個角色或產品出現在多段片子裡,就用參考式生成;需要在特定起始與結束影格對齊的鏡頭——例如循環,或接到你已剪好的素材——就用關鍵影格。當同一個節奏點需要多個切鏡時,多鏡頭生成會從同一個提示詞一次回傳多段鏡頭。
是的。環境音、擬音與對白會與影格在同一次生成中完成,而不是事後再疊上去;因此聲音事件會與模型自己「想出來」的動作對齊,而不只對齊你描述的動作。你也可以在提示詞中指導混音——例如要求「下雨且不要音樂」,就會得到下雨且沒有音樂的結果。片段也能在畫面與聲音一起延長,讓較長的剪輯不會在銜接處明顯露出接縫。
有 API,可從你自己的流程中驅動相同的生成模式:提交任務、輪詢狀態、取回資產。關於使用權:在付費方案下生成的片段,你可以用於客戶案、廣告與社群內容——具體措辭請以服務條款為準;另外也請注意,這與 FLUX 3 Dev 權重的授權問題是分開的,FLUX 3 Dev 預期會像先前的 FLUX Dev 版本一樣以非商業授權釋出。
Black Forest Labs 尚未公布 FLUX 3 Dev 的發布日期。依先前 FLUX 世代的慣例,Dev 變體通常會在託管模型推出後數週到數月內發布,並以非商業授權提供可下載的權重——是開放權重,但不是 OSI 定義下的開源。影片模型比圖像模型龐大得多,因此自架所需的 VRAM 會遠高於過去執行 FLUX 圖像權重的需求。