FB 建議貼文

選取貼文複製成功(包含文章連結)!

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

AI 新創 Black Forest Labs 正式推出 FLUX 3 Video,首波開放文字生成影片與圖片生成影片功能,透過 BFL API 與合作夥伴提供服務。新模型可生成最長 20 秒、720p HD 影片,並支援升級至 1080p Full HD,同時原生生成對白、音效與環境音,不需額外配音。FLUX 3 是 Black Forest Labs 最新的多模態 AI 模型,涵蓋影片、音訊、圖片及動作生成能力,此次則是首次正式對外開放影片生成功能。

支援文字、圖片生成影片,還能同步產生音訊

Black Forest Labs 表示,FLUX 3 並非只追求電影感畫面,而是希望更貼近真實世界,因此生成風格可依需求呈現自然、寫實、懷舊、趣味或高度風格化等不同效果,並能理解複雜指令,自由切換鏡位、場景及敘事節奏。

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

功能方面,FLUX 3 Video 除了支援文字生成影片,也提供圖片轉影片、關鍵影格(Keyframe)控制、影片續寫(Video Continuation)等能力。使用者可輸入最多 4 秒既有影片與音訊,讓 AI 接續生成後續內容,同時維持人物動作、鏡頭運動、對話與音效的一致性。

模型也支援單支影片內切換多個場景與鏡位,並可同步生成角色對話、背景音效與環境聲。官方表示,FLUX 3 Video 支援包括英文、中文、日文、西班牙文、法文、德文、葡萄牙文、俄文、印尼文、土耳其文、印地語、旁遮普語等多種語言,並具備口型同步能力。

新增草稿模式,官方稱效能達頂尖水準

此外,新版本加入 Draft Mode(草稿模式),可先快速生成低成本預覽版本,待確認內容後再輸出完整高畫質影片,讓創作者能更有效率地反覆修改與調整。

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

Black Forest Labs 表示,根據內部測試與人工評比,FLUX 3 Video 在文字生成影片表現優於目前多數主流模型,在圖片生成影片方面則與 Seedance 2.0 並列領先,整體已達到目前頂尖(State-of-the-Art,SOTA)水準。

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

在安全性方面,Black Forest Labs 強調已與第三方機構 Cinder 合作,在正式發布前完成風險評估,涵蓋未經同意私密影像及兒少性剝削內容等濫用情境,希望降低生成式 AI 遭到不當使用的風險。

官方也預告,未來 FLUX 3 將持續擴充更多控制功能,並支援結合圖片、影片與音訊等多種素材共同生成影片,同時推出 FLUX 3 Image 圖像模型,以及開放權重版本 FLUX 3 Dev。

ycr
作者

T 客邦網站、PChome 雜誌編輯,同時負責 T 客邦影新聞 YouTube 頻道及 FB、IG 等社群平台短影音製作。專注於 AI 應用、產業趨勢與軟體教學等科技內容報導。(大頭貼為 AI 生成)

發表回應
謹慎發言,尊重彼此。按此展開留言規則