日本語

製品発表GoogleProject Genie

Google、世界モデルGenie 3活用した対話型ワールド生成プロトタイプ「Project Genie」を米国で提供開始

Google DeepMindは、対話的なワールドの作成と探索を可能にする実験的な研究プロトタイプ「Project Genie」を、米国のGoogle AI Ultraサブスクライバー(18歳以上)向けに提供開始したと発表しました。

このプロトタイプは、世界モデル「Genie 3」、画像生成モデル「Nano Banana Pro」、そして大規模言語モデル「Gemini」によって駆動されるWebアプリケーションです。ユーザーはテキストプロンプトや画像を用いて、動的に拡張する環境を構築し、リアルタイムで操作しながら探索できます。

従来の静的な3Dスナップショットとは異なり、Genie 3はユーザーの移動や操作に応じて、その先の経路をリアルタイムで生成します。物理法則や物体間の相互作用もシミュレートされるため、ロボティクスからアニメーション制作まで、多様な現実世界のシナリオを再現できるとしています。

より精密なコントロールのために「World Sketching」機能が統合されました。これにより、ワールドに入る前に画像を修正し、視点(一人称・三人称)などを微調整できます。また、既存のワールドをリミックスしたり、ギャラリーからインスピレーションを得たりすることも可能です。

なお、8月に発表されたGenie 3の機能のうち、探索中に世界を変えるプロンプタブルイベントなどは、今回のプロトタイプにはまだ含まれていないと説明しています。


出典: Project Genie: Experimenting with infinite, interactive worlds(HN 675pt・321コメント)(HN Search (backfill)、2026-01-30)