Nowości
Rosyjscy hakerzy wpisali do złośliwego kodu prośbę o pomoc w budowie broni jądrowej, by zmylić AI

Badacze ESET opisali technikę GuardBreaker: grupa UAC-0099 powiązana z Rosją wkleja do złośliwych skryptów zdanie o budowie broni jądrowej, licząc na to, że wyzwoli to blokady bezpieczeństwa w narzędziach AI analizujących kod i uniemożliwi wykrycie malware.
Spis treści
Firma ESET opisała nową technikę ataku, w której hakerzy nie próbują złamać zabezpieczeń sztucznej inteligencji, lecz odwrotnie - celowo je uruchamiają. Grupa UAC-0099, powiązana z Rosją, wklejała do złośliwych skryptów zdanie o chęci zbudowania broni jądrowej, licząc na to, że system AI analizujący kod przerwie pracę, zanim wykryje właściwe zagrożenie.
Mechanizm działania jest prosty i zarazem sprytny. Systemy AI wykorzystywane do analizy złośliwego oprogramowania mają wbudowane filtry bezpieczeństwa, które reagują na treści uznane za wrażliwe - na przykład instrukcje dotyczące broni masowego rażenia. Gdy taki fragment tekstu pojawia się w analizowanym pliku, model może odmówić dalszej pracy albo skupić uwagę na neutralizowaniu rzekomego zagrożenia zamiast na właściwym kodzie.
Odwrócony jailbreak
ESET porównuje GuardBreaker do odwróconego jailbreaku. Klasyczny jailbreak ma skłonić model AI do zignorowania zasad bezpieczeństwa i wykonania czegoś zakazanego. GuardBreaker robi coś przeciwnego - świadomie aktywuje te zasady, żeby sparaliżować analizę i przemycić złośliwy kod obok systemów wykrywania.
To ma zwrócić uwagę AI na treść wrażliwą pod względem bezpieczeństwa i powstrzymać ją przed analizą reszty kodu - ESET
Badacze podkreślają, że tekst wklejony jako komentarz nie ma żadnej funkcji w samym skrypcie - jego jedynym zadaniem jest zmylenie narzędzia analitycznego opartego na dużym modelu językowym. Sam kod, gdyby nie ten zabieg, mógłby zostać wykryty jak każdy inny malware.
Nie pierwszy taki przypadek
ESET zaznacza, że GuardBreaker to rozwinięcie wcześniej obserwowanych taktyk. Już w czerwcu 2026 roku badacze opisywali ataki na łańcuch dostaw pakietów Pythona, w których napastnicy umieszczali w kodzie podobne treści dotyczące broni biologicznej i jądrowej, aby wymusić odmowę analizy przez skanery oparte na AI. GuardBreaker jest pierwszym udokumentowanym przypadkiem zastosowania tej metody przez konkretną, znaną grupę powiązaną z państwem - UAC-0099 - w realnej kampanii przeciwko infrastrukturze krytycznej.
UAC-0099 działa od co najmniej 2022 roku i wcześniej była kojarzona głównie z atakami phishingowymi na ukraińskie instytucje rządowe i firmy z sektora transportu oraz energetyki. Wykorzystanie loadera MATCHBOIL, opisywanego wcześniej przez CERT-UA jako narzędzie dystrybuowane pod przykrywką fałszywych wtyczek do popularnego edytora Notepad++, wpisuje się w dotychczasowy schemat działania grupy - infekcja pracowników infrastruktury krytycznej poprzez pozornie niegroźne narzędzia.
Ograniczenia sztucznej inteligencji w bezpieczeństwie
Juraj Janosik, wiceprezes ESET do spraw sztucznej inteligencji, ostrzega przed ślepym poleganiem na modelach AI w analizie zagrożeń.
AI i uczenie maszynowe mogą być cennymi narzędziami w bezpieczeństwie, ale nie można im ufać bezgranicznie ani traktować ich jako panaceum na każde możliwe zagrożenie - Juraj Janosik, wiceprezes ds. AI, ESET
Janosik dodaje, że jeśli analiza wspierana przez AI nie jest połączona z wielowarstwowym podejściem obejmującym badania prowadzone przez ekspertów, analizę behawioralną, systemy reputacji, sandboxing, heurystykę, telemetrię oraz inżynierię prowadzoną przez ludzi, atakujący będą szukać sposobów na manipulowanie nią lub jej obejście.
Dla firm wdrażających narzędzia bezpieczeństwa oparte na dużych modelach językowych to sygnał ostrzegawczy. Coraz więcej produktów antywirusowych i systemów SOC korzysta z AI do wstępnej klasyfikacji podejrzanych plików, co przyspiesza pracę zespołów bezpieczeństwa, ale jak pokazuje przypadek UAC-0099, tworzy też nową powierzchnię ataku - nie na infrastrukturę, lecz na sam proces wnioskowania modelu.
Sprawa dotyczy też szerszego trendu określanego jako AI evasion, czyli technik projektowanych specjalnie pod kątem omijania automatycznych systemów opartych na sztucznej inteligencji. W miarę jak coraz więcej firm zastępuje ręczną analizę malware'u modelami językowymi, tego typu ataki będą prawdopodobnie zyskiwać na popularności, ponieważ nie wymagają łamania zabezpieczeń w tradycyjnym sensie - wystarczy znajomość tego, jak model reaguje na określone słowa kluczowe.
ESET nie ujawniła, które konkretnie komercyjne narzędzia lub produkty bezpieczeństoiwe oparte na AI okazały się podatne na tę technikę, ograniczając się do opisu mechanizmu i przypisania go do kampanii UAC-0099 na Ukrainie.


