
帶有清晰文字的圖片
製作海報、產品照片和社群媒體圖形,將清晰易讀的文字直接置入圖片中,並支援多種風格和長寬比。
適用於圖片、影片和音訊的單一模型,專為真實創意工作而打造。
創作與編輯支援多種風格、長寬比和解析度的圖片,並能以多種語言在圖片中精準呈現文字。
生成最長 20 秒的影片,其中包含對話、音效和環境音,這些音訊在同一流程中生成並與動作完美匹配。
從文字生成影片、將靜態圖片動畫化、延續影片片段,或設定關鍵影格以控制從頭到尾的動作。
圖片、影片和音訊皆來自單一模型,因此在不同內容之間切換時,風格和角色能保持一致。
Flux 3 擅長處理人類面部表情、將聲音與螢幕內容匹配,以及多語言對話。
將多個鏡頭串聯起來,打造超越單一片段的完整場景。
圖片生成、帶聲音的影片,以及跨鏡頭的角色一致性。

製作海報、產品照片和社群媒體圖形,將清晰易讀的文字直接置入圖片中,並支援多種風格和長寬比。

將提示文字或靜態圖片轉換成短片,其中對話、音效和環境音已預先置入並與動作完美匹配。

在不同鏡頭之間保持相同的角色、燈光和風格,或將多個鏡頭串聯成更長的場景。
透過三個步驟,創作帶聲音的圖片和影片。
選擇您想創作的內容,然後用簡單的文字描述場景、風格和氛圍。
選擇長寬比,如果是影片,則選擇長度以及是否包含音訊。
在瀏覽器中生成,預覽結果,然後下載內建音效的圖片或影片。
關於 Flux 3 功能、影片、音訊以及如何使用的常見問題。
Flux 3 是一個多模態 AI 模型,能在單一架構中生成圖片、影片和音訊。作為一個 AI 圖片和影片生成器,它超越了靜態圖片,能創造帶有聲音的完整場景,因此單一提示即可產生圖片或帶有匹配音訊的短片。它建立在早期的 Flux 圖片模型基礎上,並增加了影片和原生音效功能。
是的。Flux 3 能生成長達 20 秒的影片,並在同一過程中產生原生音訊,因此對話、音效和環境音都能與螢幕上的內容完美同步。由於音訊和影片是同時製作的,撞擊聲會落在正確的影格上,語音也會跟隨唇部動作,無需額外的音訊編輯。
Flux 3 支援文字轉影片、圖片轉影片、影片轉影片(具備元素一致性)以及用於引導式轉場的關鍵影格控制。文字轉影片僅需提示文字即可運作,圖片轉影片能將靜態影格動畫化,而關鍵影格則讓您設定鏡頭的起點和終點。鏡頭也可以串聯成更長的、多鏡頭序列。
Flux 3 尚未在此網站上線。它正在早期測試階段逐步推出,一旦支援的整合準備就緒,我們將在此啟用生成功能。在此期間,您可以使用我們現有的 AI 圖片和影片生成器進行創作。
其主要優勢在於原生音訊是與影片同時創建的,而非在單獨的步驟中添加。由於單一模型涵蓋圖片、影片和音訊,因此聲音、風格和角色在整個場景中都能保持一致。許多其他工具會先生成無聲片段,然後讓您自行添加或同步音訊。
早期評估使用了帶有音訊的 10 秒 720p 片段,而 Flux 3 可以生成長達 20 秒的片段,並支援多種長寬比。此處最終的解析度和長度選項可能會隨著推出進程而有所變動。