Google DeepMindは、生成動画モデル「Gemini Omni 1.1 Flash」をリリースしました。本モデルは、プロダクション環境での実運用を想定したアップデートです。
新しい機能として、既存の動画を継承してシーンを延伸する仕組みが追加されました。過去のコンテキストとして最大10秒の映像を分析できます。従来のモデルが最終1秒しか参照できなかったのに対し、大幅に向上しています。
これにより、ビジュアルの一貫性や物語の整合性が維持されやすくなります。10秒単位で延伸でき、総延長は最大40秒まで可能です。
また、スタートフレームとエンドフレームを指定して、スムーズなトランジションを生成する機能も搭載されました。さらに、4K解像度での高品質な出力に対応しています。
開発者は、低解像度で素早く下書きを作成し、アイデアを検証するフローも組めます。これにより、プロトタイピングの速度向上とコスト削減が期待できます。
利用はGoogle AI StudioまたはGemini Enterprise Agent Platform経由で可能です。Gemini APIを通じて、生成動画ワークフローやメディア編集ソフトウェアへの統合がサポートされています。
出典: Gemini Omni 1.1 Flash(HN 296pt・236コメント)(HN Search (backfill)、2026-08-28)