piątek, 11 września 2026

Nowości

Anthropic ujawnia: Claude wykorzystywano do budowy dronów kamikaze i badań nad bronią biologiczną

Bezpieczeństwo AIPatryk Raba
Anthropic ujawnia: Claude wykorzystywano do budowy dronów kamikaze i badań nad bronią biologiczną
Fot. TechCrunch (Flickr), Wikimedia Commons (CC BY 2.0)
Spis treści
  1. Drony, rakiety i wirusy
  2. Inwigilacja od Bamako po Xinjiang
  3. Chińscy giganci AI kopiowali Claude na masową skalę
  4. Reakcja Anthropic i co dalej

Anthropic opublikował 10 września 2026 roku najobszerniejszy jak dotąd raport o nadużyciach swojego modelu Claude. Dokument opisuje działania wykryte i zablokowane między grudniem 2025 a sierpniem 2026 roku w siedmiu kategoriach szkód: od cyberataków, przez operacje wpływu i inwigilację, po badania nad bronią biologiczną i konwencjonalną.

Drony, rakiety i wirusy

Najbardziej niepokojące przypadki dotyczą prób budowy broni. Grupa działająca z północnego Jemenu wykorzystała Claude Code zamiast ludzkich inżynierów oprogramowania do tworzenia systemów naprowadzania dla rakiet kierowanych, wielostopniowych pocisków balistycznych o zasięgu ponad 2000 kilometrów oraz wariantów pojazdów hipersonicznych. Komórka przeprowadziła nawet próbny odpal rakiety kierowanej, który zakończył się niepowodzeniem w terenie.

Rosyjscy freelancerzy poszli dalej. Zbudowali przy pomocy Claude Code autonomiczny rój dronów kamikaze FPV, w którym pokładowy model sam wybierał cele, w tym kategorię "osoba", i wydawał polecenia detonacji bez udziału człowieka. System trenowano na zeskrobanych z sieci nagraniach walk z Ukrainy.

W obszarze broni biologicznej Anthropic zablokował w maju 2026 roku wniosek grantowy dotyczący badań gain-of-function nad wirusem chikungunya, kierowany do instytutu wojskowego przez platformę omijającą zabezpieczenia. Inny badacz spędził tygodnie planując eksperymenty nad adaptacją ptasiej grypy do organizmu ssaków. Trzydziestodniowy przegląd wrogich instytucji państwowych ujawnił około 35 odrębnych projektów badawczych, z których większość miała charakter cywilny, ale część niosła wyraźny potencjał dual-use.

Inwigilacja od Bamako po Xinjiang

Sekcja o inwigilacji pokazuje skalę wykorzystania Claude przez służby państwowe. Konsultant działający z Bamako pomógł zbudować Lakana 360 - krajową platformę nadzoru dla malijskiego wywiadu ANSE, monitorującą około 25 milionów kart SIM u wszystkich trzech operatorów komórkowych w kraju, przy czym na żądanie operatora usunięto wymóg posiadania nakazu.

Podmioty powiązane z chińskim rządem użyły Claude do śledzenia, profilowania i prób rekrutacji Ujgurów w Syrii, przy czym model tłumaczył odpowiedzi i odgrywał rolę eksperta w celu sprawdzenia jakości dezinformacji. Inne chińskie grupy tworzyły szablonowe dossier na temat katolickich kardynałów, prezbiteriańskiego kościoła na Tajwanie, tybetańskich buddystów i Falun Gong. Irańskie jednostki obsługiwały 16 kont Claude, twierdząc, że w ciągu roku inwigilowały i profilowały 6388 Irańczyków, analizując sieć 155 216 wpisów na Twitterze wskazujących 39 kont opozycji.

Chińscy giganci AI kopiowali Claude na masową skalę

Osobna, obszerna część raportu dotyczy nielegalnej destylacji, czyli wykorzystywania odpowiedzi Claude do trenowania konkurencyjnych modeli. Od lutego 2026 roku Anthropic zatrzymał siedem kampanii tego typu prowadzonych z Chin. Największa, powiązana z Alibabą, osiągała szczyt blisko 3 milionów wymian dziennie z ponad 3500 fałszywych kont, a łącznie zaobserwowano ponad 151 milionów wymian między majem a lipcem 2026 roku - zebrane transkrypty posłużyły do trenowania modeli Qwen 3.5, 3.6 i 3.7.

Moonshot AI po cichu przekierowywał zapytania klientów do Claude zamiast do własnych modeli Kimi, przekazując prawie 300 tysięcy zapytań w ciągu dziesięciu dni z 5380 fałszywych kont. DeepSeek stosował technikę przekazywania żądań użytkowników do Claude Opus bez ich wiedzy, rejestrując 12,1 miliona wymian w 14 dni, przy czym w danych ujawniły się wrażliwe materiały, w tym żywe dane dostępowe do rosyjskiej bazy rządowej i chińskiego systemu zarządzania sprawami policyjnymi.

Reakcja Anthropic i co dalej

We wszystkich opisanych przypadkach Anthropic zbanował powiązane konta, wykorzystał ustalenia do wzmocnienia zabezpieczeń oraz udzielił informacji władzom i partnerom branżowym, gdy było to zasadne. Firma wprowadziła też konkretne mechanizmy obronne: atrybucję sieci proxy na podstawie metadanych, wzmocnione klasyfikatory wykrywające próby ekstrakcji modelu wraz z premierą Fable 5, streszczanie wewnętrznego rozumowania modelu, by ograniczyć użyteczność skradzionych transkryptów, oraz mechanizm w Fable 5.1 blokujący nowym kontom API modyfikowanie treści poprzedzających rozumowanie modelu.

Wierzymy, że mamy obowiązek ujawniać złośliwe nadużycia naszych usług - Anthropic

Raport podkreśla też szerszy trend: pojedyncze osoby przy pomocy Claude osiągają rezultaty, które wcześniej wymagały całych zespołów, a część operacji działała niemal autonomicznie, w strukturach wieloagentowych z minimalnym udziałem człowieka. Skradzione klucze API zyskały w tym kontekście potrójną wartość - jako łup, jako moc obliczeniowa i jako kamuflaż dla dalszych ataków.

Dla polskich firm i instytucji korzystających z Claude raport ma praktyczne znaczenie - pokazuje, jak szybko rozwijają się techniki nadużyć API dużych modeli językowych, w tym kradzież tokenów dostępowych i budowa sieci proxy omijających regionalne blokady. To kolejny sygnał, że bezpieczeństwo wdrożeń AI w firmach wymaga monitorowania nie tylko własnych systemów, ale i tego, jak dostawcy modeli radzą sobie z nadużyciami na poziomie infrastruktury.

Anthropic zapowiedział, że kolejne tego typu raporty będą publikowane cyklicznie, w miarę jak firma rozwija swój zespół threat intelligence. Ujawnienie tak szczegółowych danych, łącznie z identyfikatorami grup i opisem technik, ma też służyć innym laboratoriom AI oraz agencjom rządowym jako materiał do wzmacniania własnych zabezpieczeń.

Udostępnij: