World Labs Fei-Fei Li pokazuje Atlas - model świata z przestrzenną inteligencją 3D
World Labs, startup Fei-Fei Li, zaprezentował Atlas - multimodalny model świata, który z pojedynczego zdjęcia generuje szczegółowe środowiska 3D z precyzyjną kontrolą kamery.
👁 135 przeczytań
World Labs, startup Fei-Fei Li, zaprezentował 1 września 2026 roku Atlas - model opisywany jako pierwszy multimodalny model świata zdolny do generowania obrazów i wideo z pikselowo dokładną kontrolą kamery oraz rekonstrukcji scen w 3D.
Atlas potrafi z pojedynczego zdjęcia 2D wygenerować do minuty wideo w rozdzielczości 1440p, zachowując przy tym sztywną spójność geometryczną i umożliwiając oglądanie sceny z dowolnego kąta. Oprócz wideo model wyprowadza też zasoby 3D - chmury punktów i tzw. gaussowskie splaty 3D - łącząc wideo, tekst, pozycje kamery i mapy głębokości we wspólny kontekst przestrzenny.
Zobacz wpis na X
Czym Atlas różni się od dotychczasowych generatorów wideo
Tradycyjne generatory wideo, takie jak Sora OpenAI, polegają na niedokładnych promptach tekstowych przy sterowaniu kątem i ruchem kamery. Atlas działa inaczej: przyjmuje trajektorie kamery i dane geometryczne jako natywne wejście, co przekłada się na znacznie precyzyjniejszą kontrolę perspektywy. World Labs opisuje go jako model zbudowany na architekturze multimodalnego autoregresyjnego dyfuzyjnego transformera, znacznie bardziej złożonej niż wczesne generatory wideo.
Pierwsze eksperymenty użytkowników na platformie X wyglądają obiecująco - między innymi deweloper Ian Curtis pokazał scenę wygenerowaną z jednego obrazu wejściowego przy użyciu Atlasa w połączeniu z bibliotekami spark.js i three.js.
Premiera Atlasa to w pewnym sensie spełnienie głównej tezy Li, którą postawiła przy zakładaniu firmy w lutym 2024 roku. Twierdziła wtedy, że stworzenie AGI - systemu AI przewyższającego ludzkie zdolności poznawcze - jest niemożliwe bez tzw. przestrzennej inteligencji (ang. spatial intelligence). Chodzi o zdolność do natywnego rozumowania o obiektach 3D, środowiskach i przestrzennych konsekwencjach interakcji między nimi - a więc o to, by AI rozumiała fizykę świata, nie tylko jego opis tekstowy.
Li wcześniej kierowała laboratorium AI Uniwersytetu Stanforda i współtworzyła Stanford Institute for Human-Centered AI. Startup zdołał przyciągnąć 1,2 miliarda dolarów finansowania od inwestorów, w tym Nvidii, AMD i Autodesk - co pokazuje, jak poważnie branża traktuje temat fizycznie świadomych modeli świata.
Na ile Atlas faktycznie domknie lukę między symulowanymi środowiskami a rozumowaniem o świecie fizycznym - odpowiedź przyniesie czas i szersze testy.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
DeepSeek V4 pokazuje, że sztuczna inteligencja z najwyższej półki przestaje być twierdząPremium
NVIDIA prezentuje Cosmos 3 Edge - model świata dla robotyki na urządzeniach brzegowychNewsy
Alibaba prezentuje Qwen3.8 z 2,4 bln parametrów i twierdzi, że to drugi najlepszy model świata - bez benchmarkówNewsy
