Google、高度な動画生成を可能にする「Gemini Omni 1.1 Flash」を発表
Google は現地時間8月27日、開発者向けの新世代生成AIモデル「Gemini Omni 1.1 Flash」の提供開始を発表した。本アップデートは、プロフェッショナルな動画制作におけるクリエイティブな制御性を大幅に向上させるものであり、Google AI Studio や Gemini Enterprise Agent Platform を通じて利用可能となっている。
技術仕様として、従来のモデルから飛躍的に向上した最大10秒間の事前コンテキスト分析機能を搭載し、シーンを最長40秒まで10秒刻みでシームレスに延長できる。さらに、始点と終点のフレームを指定することで滑らかなカメラワークやトランジションを実現するほか、360p解像度での軽量プレビューによる高速なプロトタイピング、4K解像度までの高画質アップスケール、最大3秒の動画リファレンス入力によるビジュアル一貫性の保持に対応している。
これらの機能拡張により、開発者やクリエイターは複雑なカメラ軌道や長尺のストーリーテリングを効率的に構築できるようになる。360pでの高速プレビューやコスト削減を通じて制作プロセスの効率化を図りつつ、最終段階では最高4Kの高解像度出力で商業品質の映像を仕上げることが可能であり、動画編集ソフトウェアやカスタムクリエイティブツールの開発に革新をもたらす。
開発者は Google AI Studio や Gemini Enterprise Agent Platform を経由して本モデルにアクセスし、各種アプリケーションへの統合を進めることができる。公式ドキュメントやプロンプティングガイド、サンプルコードなども公開されており、シーンの拡張や動画リファレンス、アップスケール機能を活用した開発環境の構築が直ちに可能となっている。
Gemini Omni 1.1 Flash lets you build with more control|Google
blog.google

Google 、高速画像モデル「Nano Banana 2 Lite」とビデオ生成・編集モデル「Gemini Omni Flash」を発表
Google は現地時間6月30日、生成メディアモデルの刷新を発表し、「Nano Banana 2 Lite」および「Gemini Omni Flash」の提供を開始した。
自社の・自分のAI活用状況が分かる!カンタンAI活用診断を公開中
