動画生成AI「FLUX 3 Video」提供開始:最長20秒・音声つきの動画を文章や画像から生成
30秒でわかる
- Black Forest Labsが動画生成AI「FLUX 3 Video」を提供開始(2026年8月4日)
- 文章や画像から、最長20秒・映像に合った音声(セリフ・効果音)つきの動画を生成できる。解像度は720p/1080p
- まずは開発者向けの窓口(API)と一部パートナー経由での提供。あとから自分のPCで動かせる公開版(オープンウェイト)も予定
何が変わった
画像生成AI「FLUX」で知られるBlack Forest Labsが、動画を作るAIFLUX 3 Video ↗を出しました。文章から動画を作る(text-to-video)/画像を動かして動画にする(image-to-video)の両方に対応し、最長20秒の動画を生成できます。特徴は、映像に合わせた音声(セリフ・効果音・環境音)を一緒に作る点で、口の動きと声を合わせることもできます。解像度は720p(HD)と1080p(フルHD)。ざっくり言うと「文章か画像を渡すと、音つきの短い動画がまとめて出てくる」AIです。提供はまず開発者向けの窓口(API)と一部パートナー経由から始まり、あとから自分の環境で動かせる公開版(オープンウェイト=モデルを配布して各自で動かせる形)も出す予定とされています。今すぐ誰でもアプリで使える段階ではない点に注意です。
誰に関係する
AIで動画を作りたい人、動画生成を自分のサービスに組み込みたい開発者に関係します。ただし当面はAPIやパートナー経由が中心で、一般向けアプリの提供時期は明記されていません。