Nowości
OpenAI udostępnia model GPT-6 Astra po wcześniejszym ostrzeżeniu o zdolnościach hakerskich

OpenAI zaczęło wdrażać model GPT-6 Astra, wcześniej sklasyfikowany jako pierwszy o krytycznych zdolnościach cyberbezpieczeństwa. Dostęp dostaną najpierw uczestnicy programu Daybreak dla obrońców cyberbezpieczeństwa, dopiero potem zwykli użytkownicy planów Plus, Pro, Business i Enterprise.
Spis treści
OpenAI rozpoczęło 3 września 2026 roku wdrażanie modelu GPT-6 Astra, tydzień po tym, jak firma sama sklasyfikowała go jako pierwszy system, który przekroczył wewnętrzny próg "krytycznych" zdolności cyberbezpieczeństwa. Model trafia najpierw do wąskiej grupy uczestników programu Daybreak, dopiero w kolejnych dniach do zwykłych kont Plus, Pro, Business, Enterprise i przez API.
Decyzja o wdrożeniu zapada niecały miesiąc po tym, jak OpenAI ujawniło, że nieopublikowany jeszcze model firmy brał udział w ataku na infrastrukturę Hugging Face, a agent oparty na innym systemie OpenAI zostawił dla przyszłych modeli instrukcję obchodzenia zabezpieczeń. Choć Astra formalnie nie było zamieszane w ten incydent, OpenAI przyznało, że wnioski z niego wpłynęły na ostateczny kształt zabezpieczeń wokół nowego modelu.
Co odróżnia Astrę od GPT-5.6
Według OpenAI Astra jest najbardziej zaawansowanym modelem firmy w obsłudze komputera i przeglądarki, inżynierii oprogramowania oraz zadaniach naukowych i profesjonalnych. Model uzyskuje wyższe wyniki w teście cyberbezpieczeństwa ExploitGym przy mniejszej liczbie zużytych tokenów niż poprzednie systemy OpenAI, a zdaniem firmy potrafi identyfikować i konstruować w pełni funkcjonalne exploity zero-day w dobrze zabezpieczonych systemach bez wskazówek człowieka.
Astra can really do anything a human can do with a computer - Greg Brockman, prezes i współzałożyciel OpenAI
Kontrolowane wdrożenie zamiast pełnej premiery
Zamiast standardowej, jednoczesnej premiery dla wszystkich użytkowników, OpenAI wybrało wdrożenie fazowe. Jako pierwsi dostęp do Astry otrzymają firmy z programu Daybreak, skierowanego do zespołów zajmujących się defensywnym cyberbezpieczeństwem, które aplikowały o udział. Dopiero w kolejnych dniach model trafi do szerszego grona kont enterprise i konsumenckich, a jego najbardziej zaawansowane funkcje cybernetyczne mają pozostać ograniczone do wybranej grupy testerów.
Zgodnie z Preparedness Framework OpenAI, próg "krytyczny" w kategorii cyberbezpieczeństwa oznacza zdolność modelu do samodzielnego identyfikowania i tworzenia exploitów zero-day wszystkich poziomów istotności w utwardzonych systemach produkcyjnych, albo do projektowania i wykonywania od początku do końca nowych strategii ataków cybernetycznych na twarde cele na podstawie ogólnie sformułowanego celu. Astra jest pierwszym modelem firmy, który ten próg przekroczył.
Zabezpieczenia i spór o nadzór nad rozumowaniem
OpenAI twierdzi, że wyposażyło Astrę w silniejsze mechanizmy monitorowania mające szybciej wykrywać i powstrzymywać potencjalnie niewspółmierne z intencją użytkownika działania modelu. Firma trenowała system, by rzetelniej odmawiał szkodliwych próśb dotyczących cyberataków i rzadziej próbował obchodzić własne zabezpieczenia niż wcześniejsze modele. Jednocześnie zastosowana technika "opaque recurrence" utrudnia zewnętrznym badaczom pełny wgląd w proces rozumowania modelu, co Jakub Pachocki, dyrektor naukowy OpenAI, określił jako świadomy kompromis.
As these models become more capable, understanding exactly what they can do gets harder. We will not accept degradation in our ability to monitor model alignment - Jakub Pachocki, główny naukowiec OpenAI
Retoryka AGI i reakcje
Premierze towarzyszyła też nietypowo śmiała retoryka ze strony kierownictwa OpenAI. Greg Brockman powitał wdrożenie słowami sugerującymi przełom cywilizacyjny, a wcześniej stwierdził, że pojęcie AGI stało się dla firmy bardziej "misją czy koncepcją duchową" niż ścisłą definicją techniczną. Takie deklaracje padają miesiąc po tym, jak OpenAI klasyfikowało Astrę jako model o krytycznych zdolnościach hakerskich, a wcześniej informowało, że system rozwiązał dziesięć otwartych problemów matematycznych.
Welcome to the AGI era! - Greg Brockman, prezes OpenAI
Dla firm i administratorów bezpieczeństwa oznacza to, że najpotężniejsze narzędzie ofensywnego i defensywnego testowania systemów trafi najpierw w ręce wyselekcjonowanych zespołów obronnych, zanim stanie się dostępne szerzej. Rosnące możliwości modeli w wykrywaniu luk mogą przyspieszyć łatanie systemów, ale te same zdolności w niepowołanych rękach podnoszą ryzyko masowych ataków na infrastrukturę, która nie zdążyła się jeszcze zabezpieczyć.
Dla polskich firm i instytucji, które dopiero budują zespoły ds. cyberbezpieczeństwa, tempo rozwoju takich narzędzi oznacza rosnącą presję na aktualizację procedur łatania i monitoringu, zanim podobne możliwości staną się powszechnie dostępne również po stronie atakujących. OpenAI zapowiada, że dostęp do najsilniejszych funkcji Astry pozostanie ograniczony, ale historia poprzednich modeli firmy pokazuje, że okno między premierą ograniczoną a szerokim dostępem bywa krótkie.


