Nowości

Google udostępnia Project Genie, generator interaktywnych światów oparty na Genie 3

ModelePatryk Raba
Fot. Gciriani, Wikimedia Commons (CC BY-SA 4.0)

Google DeepMind wypuściło Project Genie, eksperymentalne narzędzie tworzące nawigowalne wirtualne światy z tekstu i obrazów. Na razie dostają je tylko dorośli użytkownicy Google AI Ultra w USA.

Spis treści
  1. Jak działa generowanie w ruchu
  2. Ograniczenia i skala treningu
  3. Zastosowania poza rozrywką

Google DeepMind udostępnił 29 stycznia 2026 roku Project Genie, prototyp badawczy, który zamienia tekstowy opis lub zdjęcie w eksplorowalny, interaktywny świat generowany w czasie rzeczywistym. Narzędzie trafiło na razie tylko do dorosłych subskrybentów planu Google AI Ultra w Stanach Zjednoczonych, ale firma zapowiada rozszerzenie na kolejne kraje.

Project Genie działa na trzech filarach, które Google nazywa world sketching, world exploration i world remixing. Pierwszy pozwala naszkicować świat za pomocą promptu tekstowego lub wgranego zdjęcia, z podglądem generowanym przez Nano Banana Pro jeszcze przed wejściem do środowiska. Użytkownik wybiera perspektywę, pierwszoosobową lub trzecioosobową, oraz sposób poruszania się, chodzenie, jazdę albo latanie.

Jak działa generowanie w ruchu

Drugi filar, world exploration, odpowiada za samą nawigację. Zamiast renderować z góry gotowy, statyczny model trójwymiarowy, Genie 3 dogenerowuje kolejny fragment świata na bieżąco, w zależności od tego, dokąd idzie użytkownik i jakie działania wykonuje. Google opisuje to jako generowanie ścieżki przed użytkownikiem w czasie rzeczywistym, na podstawie podejmowanych przez niego decyzji, a nie z wcześniej zaplanowanej mapy.

Trzeci element, world remixing, umożliwia przetwarzanie istniejących światów w nowe wersje. Google przygotował kuratorowaną galerię przykładowych światów oraz funkcję losowania, a wygenerowane sesje eksploracji można zapisać jako wideo i pobrać na dysk.

Ograniczenia i skala treningu

Model bazujący na Genie 3 nie ma jednej, jasno podanej liczby godzin treningowych w oficjalnym ogłoszeniu Google, ale firma otwarcie wskazuje ograniczenia narzędzia. Wygenerowane światy mogą nie wyglądać w pełni realistycznie i nie zawsze trzymają się dosłownie prompta, załączonego obrazu czy praw fizyki. Postacie w środowisku bywają mniej podatne na kontrolę i reagują z zauważalnym opóźnieniem, a każdy przebieg eksploracji jest ograniczony do 60 sekund generowania. Zabrakło też funkcji promptable events, czyli zmieniania zdarzeń w trakcie eksploracji, którą Google zapowiadał jeszcze w sierpniu 2025 roku przy premierze samego Genie 3.

Genie 3 generuje ścieżkę przed Tobą w czasie rzeczywistym na podstawie podejmowanych działań - z ogłoszenia Google DeepMind.

Zastosowania poza rozrywką

Google przedstawia Project Genie jako pierwszy krok do udostępnienia szerszej publiczności technologii, która wcześniej trafiała wyłącznie do wybranych badaczy i partnerów testowych. Zespół, który podpisał ogłoszenie, tworzą Diego Rivas, group product manager w Google DeepMind, Elliott Breece, product manager w Google Labs, oraz Suz Chambers, dyrektorka Google Creative Lab. W tekście wskazują na zastosowania wykraczające poza samą rozrywkę, od symulacji dla robotyki, przez modelowanie animacji i fikcji, po odtwarzanie realnych lokacji i scenariuszy historycznych.

Dla polskich użytkowników narzędzie na razie jest niedostępne, bo Google ogranicza premierę do rynku amerykańskiego i planu Ultra, najdroższego pakietu subskrypcyjnego firmy. To powtarzający się wzorzec przy najnowszych, najbardziej obliczeniowo kosztownych funkcjach Google, wcześniej podobnie wprowadzano na przykład wybrane funkcje wideo Gemini. Skala rozszerzenia na inne kraje i tańsze plany nie została podana.

Project Genie wpisuje się w szerszy trend modeli świata, czyli systemów AI, które nie tylko generują obraz czy wideo, ale symulują interakcję i konsekwencje działań w czasie rzeczywistym. Google DeepMind i konkurenci, w tym część chińskich laboratoriów, od miesięcy prezentują podobne prototypy jako potencjalny kierunek rozwoju gier, symulacji szkoleniowych i syntetycznych danych treningowych dla robotów. Project Genie jest pierwszą wersją tej technologii wypuszczoną do płacących użytkowników, a nie tylko prezentowaną na materiałach demonstracyjnych.

Udostępnij: