Hinakira AI News

HinakiraAI News

画像・動画・音声AIPICK OF THE DAY

動画生成AI「FLUX 3 Video」が一般公開される、1080p・20秒の動画を生成可能で近日中にオープンモデルも公開予定

GIGAZINE公開: 2026年8月5日
出典:GIGAZINE

この記事のポイント

  • 1最大20秒の1080p音声付き動画を生成し、人間の評価で現行トップクラスの性能を記録
  • 2開始・終了フレームの画像指定や動画内テキストの指定など、クリエイター向けの高度な制御機能を搭載
  • 3低価格で結果をプレビューできる「ドラフトモード」により、生成コストの最適化が可能

要約

Black Forest Labsは、高性能動画生成AI「FLUX 3 Video」を一般公開しました。このモデルは最大1080p(フルHD)の解像度で、音声付きの動画を最長20秒間生成できるのが最大の特徴です。特筆すべきは、テキストからの動画生成(Text-to-Video)だけでなく、画像を入力として開始・終了フレームを指定する機能や、動画内の特定の文字描写を指定する機能、さらには既存動画の続きを生成する機能など、高度な制御が可能である点です。また、最終的な出力を前に低コスト(1秒あたり約9.45円)でプレビューを確認できる「ドラフトモード」も搭載されています。人間による評価テストでは、Text-to-VideoおよびImage-to-Videoの両部門で既存の主要モデルを凌ぐ最高性能を記録。今後、より高解像度な4K対応や、モデルの重みを公開する「FLUX 3 Dev」のリリースも予定されています。

出典:GIGAZINE の情報をもとにAIが要約

当サイトの考察

ヒナキラです!動画生成AI界に、真打ちが登場しましたね。先週、中国のMiniMax H3がオープンモデルとしてランキング首位を獲得したニュースをお伝えしたばかりですが、この「FLUX 3 Video」はそのさらに上を行くポテンシャルを秘めています。特筆すべきは「20秒」という長さと「音声付き」という点。これまでは数秒の無音動画を繋ぎ合わせるのが定石でしたが、一本でシーンを完結させられるのはクリエイターにとって革命的です。 個人ユーザーにとって嬉しいのは「ドラフトモード」の存在です。動画生成はガチャ要素が強く、課金が嵩みがちですが、低コストで方向性を確認できるのは非常に良心的。さらに、近日公開予定の「FLUX 3 Dev(オープンモデル)」は、かつてのStable Diffusionのようにローカル環境での活用や、特定のキャラを学習させるLoRAの開発を加速させるでしょう。先週お伝えした「AI MVでの顔崩れ」問題なども、このモデルの制御力の高さ(開始・終了フレーム指定)によって解決に向かうはずです。副業で動画制作を考えている人は、今すぐチェックすべきツールですよ!

よくある質問

Q商用利用は可能ですか?
A

現在はAPI経由での提供となっており、利用規約に基づいた料金を支払うことで商用利用が可能です。今後公開予定のオープンモデル「Dev版」については、非商用ライセンスになる可能性があるため続報に注目です。

Q日本語のプロンプトには対応していますか?
A

記事内では「多言語での対話」に対応していると記述されており、プロンプトにおいても日本語を理解する可能性が高いですが、基本的には英語の方が意図を正確に反映しやすい傾向にあります。

Q自分の持っている画像から動画を作れますか?
A

はい、可能です。Image-to-Video機能により、手持ちの画像を動画の最初のフレームや最後のフレームとして指定し、その間をAIに補完させることができます。

用語解説

オープンモデル(オープンウェイト)

AIモデルの内部データ(重み)が公開され、誰でも自身のサーバーなどで実行・カスタマイズ可能なモデルのこと。

ドラフトモード

本生成の前に、低解像度や低ステップ数で高速・安価に仕上がりイメージを確認できる試作モード。

リップシンク

音声に合わせてキャラクターの唇の動きを同期させる技術。FLUX 3 Videoは音声生成も含むため、自然な口の動きが期待できる。

※ この記事の要約・考察・FAQ・用語解説はAIによって生成されています。正確な情報は元記事をご確認ください。

この記事をシェアする

ヒナキラ

ヒナキラ

Hinakira AI News 編集長

AIツール・LLM・プロンプト活用術を中心に、個人クリエイター・副業者向けのAI最新情報を毎日お届けしています。AI歴3年以上、いろんな用途に実際に使って試してきた知見をもとに、読者が「自分ごと」として活用できる考察を心がけています。