画像・動画・音声AIPICK OF THE DAY
動画生成AI「FLUX 3 Video」が一般公開される、1080p・20秒の動画を生成可能で近日中にオープンモデルも公開予定
GIGAZINE公開: 2026年8月5日
出典:GIGAZINE
この記事のポイント
- 1最大20秒の1080p音声付き動画を生成し、人間の評価で現行トップクラスの性能を記録
- 2開始・終了フレームの画像指定や動画内テキストの指定など、クリエイター向けの高度な制御機能を搭載
- 3低価格で結果をプレビューできる「ドラフトモード」により、生成コストの最適化が可能
要約
Black Forest Labsは、高性能動画生成AI「FLUX 3 Video」を一般公開しました。このモデルは最大1080p(フルHD)の解像度で、音声付きの動画を最長20秒間生成できるのが最大の特徴です。特筆すべきは、テキストからの動画生成(Text-to-Video)だけでなく、画像を入力として開始・終了フレームを指定する機能や、動画内の特定の文字描写を指定する機能、さらには既存動画の続きを生成する機能など、高度な制御が可能である点です。また、最終的な出力を前に低コスト(1秒あたり約9.45円)でプレビューを確認できる「ドラフトモード」も搭載されています。人間による評価テストでは、Text-to-VideoおよびImage-to-Videoの両部門で既存の主要モデルを凌ぐ最高性能を記録。今後、より高解像度な4K対応や、モデルの重みを公開する「FLUX 3 Dev」のリリースも予定されています。
出典:GIGAZINE の情報をもとにAIが要約
当サイトの考察
“
ヒナキラです!動画生成AI界に、真打ちが登場しましたね。先週、中国のMiniMax H3がオープンモデルとしてランキング首位を獲得したニュースをお伝えしたばかりですが、この「FLUX 3 Video」はそのさらに上を行くポテンシャルを秘めています。特筆すべきは「20秒」という長さと「音声付き」という点。これまでは数秒の無音動画を繋ぎ合わせるのが定石でしたが、一本でシーンを完結させられるのはクリエイターにとって革命的です。
個人ユーザーにとって嬉しいのは「ドラフトモード」の存在です。動画生成はガチャ要素が強く、課金が嵩みがちですが、低コストで方向性を確認できるのは非常に良心的。さらに、近日公開予定の「FLUX 3 Dev(オープンモデル)」は、かつてのStable Diffusionのようにローカル環境での活用や、特定のキャラを学習させるLoRAの開発を加速させるでしょう。先週お伝えした「AI MVでの顔崩れ」問題なども、このモデルの制御力の高さ(開始・終了フレーム指定)によって解決に向かうはずです。副業で動画制作を考えている人は、今すぐチェックすべきツールですよ!
よくある質問
Q商用利用は可能ですか?
A
現在はAPI経由での提供となっており、利用規約に基づいた料金を支払うことで商用利用が可能です。今後公開予定のオープンモデル「Dev版」については、非商用ライセンスになる可能性があるため続報に注目です。
Q日本語のプロンプトには対応していますか?
A
記事内では「多言語での対話」に対応していると記述されており、プロンプトにおいても日本語を理解する可能性が高いですが、基本的には英語の方が意図を正確に反映しやすい傾向にあります。
Q自分の持っている画像から動画を作れますか?
A
はい、可能です。Image-to-Video機能により、手持ちの画像を動画の最初のフレームや最後のフレームとして指定し、その間をAIに補完させることができます。
用語解説
オープンモデル(オープンウェイト)
AIモデルの内部データ(重み)が公開され、誰でも自身のサーバーなどで実行・カスタマイズ可能なモデルのこと。
ドラフトモード
本生成の前に、低解像度や低ステップ数で高速・安価に仕上がりイメージを確認できる試作モード。
リップシンク
音声に合わせてキャラクターの唇の動きを同期させる技術。FLUX 3 Videoは音声生成も含むため、自然な口の動きが期待できる。
※ この記事の要約・考察・FAQ・用語解説はAIによって生成されています。正確な情報は元記事をご確認ください。

ヒナキラ
Hinakira AI News 編集長
AIツール・LLM・プロンプト活用術を中心に、個人クリエイター・副業者向けのAI最新情報を毎日お届けしています。AI歴3年以上、いろんな用途に実際に使って試してきた知見をもとに、読者が「自分ごと」として活用できる考察を心がけています。
