AI企業World Labsは、テキストや画像、3D空間を統合的に扱う次世代の世界モデル「Atlas」を発表しました。世界モデルとは、現実世界の物理特性や物体の構造などを学習して再現できるAIモデルを指します。
World Labsが世界モデル「Atlas」発表、少数画像から3D空間生成や1440p動画出力に対応
Atlasは、3D空間コンテキストを保持し、自由なカメラ制御による生成や、少数の画像からの空間再構成に対応しています。特に1枚の画像から3D空間を生成できる点が特徴として挙げられており、指示に忠実なカメラワークを実現するとされています。また、最高1440pの解像度での動画生成も可能とされ、バレットタイム映像の作成やロボティクス向けのシミュレーションにも活用できるとのことです。
同社は現在、一部パートナー向けに早期アクセスを提供しており、自社製品「Marble」などへ順次統合する予定であると報じられています。
報道・反応(2 媒体を統合):