★4 研究 EN The Decoder by Synapse Flow 編集部

Black Forest LabsのFlux 3、最長20秒のネイティブ音声付き動画生成を実現

Flux 3 generates videos with native audio up to 20 seconds long, a first for Black Forest Labs

記事のポイント

📰ニュース

Black Forest Labsが、ネイティブ音声付きの最長20秒の動画を生成できるマルチモーダル基盤モデル「Flux 3」を発表しました。

🔍注目ポイント

画像・動画・音声から学習し、動画と同期した音声を生成できる点が画期的で、市場リーダーSeedance 2.0をわずかに上回るとされています。

🔮これからどうなる

動画コンテンツ制作の効率化や表現の幅が広がり、将来的にはロボット分野への応用で新たな体験が生まれる可能性があります。

Flux 3は、Black Forest Labsが開発したマルチモーダル基盤モデルで、同社は最終的に世界モデルの構築を目指しています。
現在、ロボットタスクでのテストも進められており、動画生成だけでなく幅広い応用が期待されます。
💡
編集部の視点

動画に自然な音声が自動で付くのはすごいですね。これで個人でも高品質なショート動画が作りやすくなりそうです。

元記事を読む →

関連記事