モデル・3D
World Labs、世界モデルAtlasを早期提供
原題: Atlas: A World Model for Spatial Intelligence
生成、3D再構築、ロボットシミュレーションを共通モデルで処理
World Labsは9月1日、新しい世界モデル「Atlas」を発表しました。
テキスト、画像、動画、3Dを同じ空間コンテキストで扱う、マルチモーダル自己回帰拡散Transformerです。
入力画像やカメラ姿勢、深度情報を基に、視点を動かした映像や3D空間を生成します。
少数の画像から3D点群やGaussian splatを含む明示的な3D表現を再構築できます。
画像生成ではテキスト描画や複雑な指示、360度画像にも対応します。
ロボット分野では、実世界の映像からナビゲーションや物体操作のシミュレーションを構築するReal-to-Simへ利用できます。
カメラ制御した生成は最大約1分、1440pまで対応するとしています。
比較結果はWorld Labsが公開した自社評価であり、独立評価ではありません。
Atlasは選定パートナー向け早期アクセスとして提供され、利用希望者は申請できます。