🔥 5 promocji w KinetyceGemini Pro 170 zł -91%Adobe CC 169 zł -84%Brain.fm 109 zł -70%i 2 więcej do 13.09 Zobacz →
Przejdź do treści
Newsy

World Labs Fei-Fei Li pokazuje Atlas - model świata z przestrzenną inteligencją 3D

World Labs, startup Fei-Fei Li, zaprezentował Atlas - multimodalny model świata, który z pojedynczego zdjęcia generuje szczegółowe środowiska 3D z precyzyjną kontrolą kamery.

2 min czytania
World Labs Fei-Fei Li pokazuje Atlas - model świata z przestrzenną inteligencją 3D

👁 135 przeczytań

World Labs, startup Fei-Fei Li, zaprezentował 1 września 2026 roku Atlas - model opisywany jako pierwszy multimodalny model świata zdolny do generowania obrazów i wideo z pikselowo dokładną kontrolą kamery oraz rekonstrukcji scen w 3D.

Atlas potrafi z pojedynczego zdjęcia 2D wygenerować do minuty wideo w rozdzielczości 1440p, zachowując przy tym sztywną spójność geometryczną i umożliwiając oglądanie sceny z dowolnego kąta. Oprócz wideo model wyprowadza też zasoby 3D - chmury punktów i tzw. gaussowskie splaty 3D - łącząc wideo, tekst, pozycje kamery i mapy głębokości we wspólny kontekst przestrzenny.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Czym Atlas różni się od dotychczasowych generatorów wideo

Tradycyjne generatory wideo, takie jak Sora OpenAI, polegają na niedokładnych promptach tekstowych przy sterowaniu kątem i ruchem kamery. Atlas działa inaczej: przyjmuje trajektorie kamery i dane geometryczne jako natywne wejście, co przekłada się na znacznie precyzyjniejszą kontrolę perspektywy. World Labs opisuje go jako model zbudowany na architekturze multimodalnego autoregresyjnego dyfuzyjnego transformera, znacznie bardziej złożonej niż wczesne generatory wideo.

Pierwsze eksperymenty użytkowników na platformie X wyglądają obiecująco - między innymi deweloper Ian Curtis pokazał scenę wygenerowaną z jednego obrazu wejściowego przy użyciu Atlasa w połączeniu z bibliotekami spark.js i three.js.

Premiera Atlasa to w pewnym sensie spełnienie głównej tezy Li, którą postawiła przy zakładaniu firmy w lutym 2024 roku. Twierdziła wtedy, że stworzenie AGI - systemu AI przewyższającego ludzkie zdolności poznawcze - jest niemożliwe bez tzw. przestrzennej inteligencji (ang. spatial intelligence). Chodzi o zdolność do natywnego rozumowania o obiektach 3D, środowiskach i przestrzennych konsekwencjach interakcji między nimi - a więc o to, by AI rozumiała fizykę świata, nie tylko jego opis tekstowy.

Li wcześniej kierowała laboratorium AI Uniwersytetu Stanforda i współtworzyła Stanford Institute for Human-Centered AI. Startup zdołał przyciągnąć 1,2 miliarda dolarów finansowania od inwestorów, w tym Nvidii, AMD i Autodesk - co pokazuje, jak poważnie branża traktuje temat fizycznie świadomych modeli świata.

Na ile Atlas faktycznie domknie lukę między symulowanymi środowiskami a rozumowaniem o świecie fizycznym - odpowiedź przyniesie czas i szersze testy.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 336 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie