AIToday
画像生成AIビジネス・産業SiliconANGLE AI掲載日時: 2026年9月2日 13:003分で読める

World Labs、1枚画像から3D世界を生成する「Atlas」公開

LINEで送る
World Labs、1枚画像から3D世界を生成する「Atlas」公開

要点

  • World LabsがAtlasを公開。1枚の画像から3Dシーンを構築する世界モデルだ。

  • 精密なカメラ制御で映像を生成。競合を上回る初期テスト結果を示す。

  • ロボット訓練を狙う。

3つのポイント

  1. 何が起きたか

    Fei-Fei Li氏が共同創業したAIスタートアップWorld Labsが、1枚の2D画像から詳細な3Dシミュレーション環境を作り出すマルチモーダル世界モデル「Atlas」を公開した。1440pの映像を最大1分間、精密なカメラ制御付きで生成し、点群やガウシアンスプラットなどの3Dアセットも出力できる。

  2. なぜ重要か

    Atlasは、シミュレーション環境と物理的推論を橋渡しし、Li氏の空間知能理論(AIが物理世界を理解するには3Dの物体、人々、相互作用を推論する必要がある)を実現することを目指す。同スタートアップはNvidia、AMD、Autodeskなどから12億ドルを調達しており、真のターゲットはロボット訓練とみられる。国内の映像制作やゲーム業界では、静止画から3D空間を生成する技術活用が進む可能性がある。

  3. 注目点

    ブラインドテストでは、Atlasはカメラ経路の忠実性においてGemini Omni FlashやFLUXなどの競合製品を圧倒的に上回った。現在は一部の企業向けに早期アクセスで利用可能だが、一般公開の時期は未発表だ。

この記事についてAIに質問する →

背景と解説

World LabsによるAtlasの発表は、Fei-Fei Li氏の空間知能ビジョンへの具体的な一歩だ。スタンフォード大学のAIラボを率い、スタンフォード人間中心AI研究所を共同設立したLi氏は、物理世界の理解なしにAGIは不可能だと主張し、2024年2月にWorld Labsを立ち上げた。マルチモーダル自己回帰拡散トランスフォーマーアーキテクチャを基盤とするAtlasは、カメラ軌道とジオメトリを後付けではなくネイティブ入力として扱う点で、初期の動画生成モデルを一歩先んじている。

Nvidia、AMD、Autodeskからの12億ドルの資金調達は、このアプローチへの投資家の強い信頼を示している。しかし、Atlasが直面する競争は激しく、Odyssey、Yann LeCun氏が設立したAMI Labs、Niantic Spatialなどの競合各社が、世界モデルの異なる側面に注力している。Atlasの賭けは、単一の基盤モデルがシミュレーション、再構築、カメラ制御を統合し、より統合されたソリューションを提供できるかどうかだ。

真の証明は、より広く利用可能になり、初期の印象的な結果が複雑な実世界シナリオでも維持されるかどうかをユーザーがテストできるようになったときにもたらされる。それまでは、特にカメラ経路の忠実性におけるGemini Omni FlashやFLUXへの圧倒的な優位性といった初期のベンチマークでの勝利は有望な兆候だが、市場は依然として競争が激しい。

よくある質問

Atlasは従来の動画生成ツールと何が違うのか?
Soraのようなテキストプロンプト型ジェネレーターと異なり、Atlasはカメラ軌道とジオメトリをネイティブ入力として取り込み、精密な視点制御を実現する。また、シーンを3Dで再構築する。
現在、誰がAtlasを利用できるのか?
Atlasは一部の企業向けに早期アクセスで提供されている。一般公開日は発表されていない。
SiliconANGLE AI元記事を読む
LINEで送る

「画像生成」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Google Pics、AI編集でWorkspaceにThe Verge AI · 10時間前
  • Google Pics、AI画像でCanvaに対抗TechCrunch AI · 10時間前
  • AI画像に「気持ち悪さ」感じる消費者ITmedia AI+ · 1日前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へグーグル、画像AIツール「Google Pics」発表