画像も動画も3D空間も生成可能な世界モデル「Atlas」が登場、「1枚の画像から3D空間を生成」「指示に忠実なカメラワーク」「1440pの動画生成」など多機能なモデル

「世界モデル」とは、現実世界の物理特性や物体の構造などを学習して再現できるAIモデルを指します。新たに、AI企業のWorld Labsが世界モデル「Atlas」を発表しました。
Atlas: A World Model for Spatial Intelligence | World Labs
https://www.worldlabs.ai/blog/atlas
Introducing Atlas; A Foundation Model for Spatial Intelligence - YouTube

Atlasは1枚の画像をもとに「その画像の周囲の世界」を映す動画を生成できます。動画の長さは最大1分、解像度は最大1440pで、カメラの動きや角度といった指示を正確に反映できるのが特徴です。

AtlasとほかのAIモデルのカメラ制御性能を人間に比較させた結果が以下。横軸は「Atlasの方が優れていると評価された割合」を示しています。GoogleのGemini Omni Flashに対して81%の勝率を記録したほか、MiniMaxのMiniMax H3に対しても75%の勝率を記録しています。

動画だけでなく画像も生成可能。以下の例では左上の「ぬいぐるみが写った画像」を入力しつつカメラアングルの変更を指示して「ぬいぐるみを背後から撮影した画像」を出力しています。

複数の参考画像を入力して景色を再現することもできます。

また、単純な画像生成にも対応しています。

画像や動画だけでなく3D空間を出力することもできます。1枚の画像をもとに3D空間を生成する例が以下。まず、「どこかの通路の画像」を入力。

Atlasが画像に含まれていない部分の景色を生成。

ガウシアンスプラッティングによって景色から3D空間データを形成して出力します。

Atlasは一部のパートナーを対象に限定公開されている段階で、数週間以内にアーリーアクセスが始まる予定です。アーリーアクセスに参加したいユーザーはウェイトリストに登録する必要があります。
Atlas is our scalable foundation model that can perceive, generate, reason, and interact with virtual and physical worlds.
— World Labs (@theworldlabs) September 1, 2026
We're opening up early access in the coming weeks.
Learn more and sign up here:https://t.co/SHjFaNWedP
・関連記事
ゲームみたいに移動可能な世界をリアルタイム生成できるAI「HappyOyster 1.0」が登場したので使ってみた - GIGAZINE
GoogleストリートビューとGoogleのインタラクティブな世界構築ツール「Project Genie」が連携し実世界の画像をもとにしたリアルな世界を生成可能に - GIGAZINE
シミュレーション世界で複数人が相互作用できるマルチエージェント世界モデル「Agora-1」が登場 - GIGAZINE
ゲーム用の3D世界を生成できる「HY-World 2.0」が登場、動画ではなく3DCGの世界を構築してUnityやUE5に出力できる - GIGAZINE
「画像からゲームのように視点操作可能な3Dシーンを生成するAI」をWorld Labsが発表、実際に3Dシーンを探索できるデモページも公開中 - GIGAZINE
テキスト・画像・動画から3Dワールドを生成するマルチモーダルワールドモデル「Marble」が一般公開される - GIGAZINE
・関連コンテンツ
You can read the machine translated English article A world model called 'Atlas' has appeare….







