AI pomagała atakować rządy i budować broń. Anthropic ujawnia działania Chin i Rosji

Anthropic

Firma Anthropic przekazała w czwartek, że w ciągu ostatnich ośmiu miesięcy udaremniła szereg przypadków wykorzystania swoich modeli Claude w atakach cybernetycznych. Miało chodzić o działania m.in. Chin i Rosji.


  • Anthropic wykryło próby wykorzystania Claude’a przez chińskie firmy do trenowania własnych modeli AI.
  • Alibaba miało wygenerować ponad 151 mln interakcji, korzystając z ponad 3500 fałszywych kont.
  • Moonshot i DeepSeek miały z kolei przesyłać do Claude’a prawdziwe rozmowy użytkowników i wykorzystywać jego odpowiedzi do szkolenia własnych modeli.
  • Grupa odpowiadająca profilowi Midnight Blizzard miała używać AI podczas phishingu, przejmowania sesji w hotelowych sieciach Wi-Fi oraz ataków na konta WhatsApp.

AI mogła zostać wykorzystana przez hakerów?

Anthropic w swoim najnowszym raporcie dotyczącym analizy cyberzagrożeń przekazało, że przez ostatnie osiem miesięcy udaremniło ataki przeprowadzane przez siedem laboratoriów z siedzibą w Chinach.

Wśród wymienionych przez firmę podmiotów znalazły się: Alibaba, Moonshot, DeepSeek oraz Xiaomi.

Anthropic twierdzi, że w okresie od maja do lipca 2026 r. zidentyfikowało ponad 151 mln interakcji związanych z działalnością firmy Alibaba.

W szczytowym momencie liczba zapytań sięgała niemal 3 mln dziennie i pochodziła z ponad 3500 kont uznanych przez firmę za fałszywe.

Miało chodzić o wykorzystywanie Claude’a do tzw. destylacji modeli.

Jest to proces polegający na trenowaniu „mniejszego” modelu AI przy wykorzystaniu odpowiedzi generowanych przez „większy” i bardziej zaawansowany model.

Dzięki temu można ograniczyć koszty tworzenia własnego systemu.

Z kolei firmy Moonshot i DeepSeek miały wykorzystywać Claude’a nie tylko do testowania jego możliwości.

Rzekomo przesyłały do tego modelu prawdziwe rozmowy swoich użytkowników, które mogły zawierać poufne informacje.

Następnie odpowiedzi Claude’a miały być wykorzystywane do trenowania ich własnych modeli AI.

AI pomagała rosyjskim hakerom?

Jeszcze poważniejsze są ustalenia dotyczące cyberataków przypisywanych grupie, której sposób działania odpowiadał profilowi rosyjskiego podmiotu znanego jako Midnight Blizzard, który rząd USA powiązał wcześniej z rosyjską Służbą Wywiadu Zagranicznego.

Grupa miała prowadzić kampanie phishingowe, przejmować sesje użytkowników korzystających z hotelowych sieci Wi-Fi oraz uzyskiwać dostęp do kont w komunikatorze WhatsApp.

Celem były m.in. podmioty związane z ukraińskim rządem, wojskiem i dyplomacją.

Claude niemal wykorzystywany przy produkcji broni

Anthropic wskazuje też m.in. na próby wykorzystania modelu przy tworzeniu oprogramowania dla broni palnej, pocisków rakietowych, uzbrojonych dronów i bomb.

Raport obejmuje także przypadki wykorzystania Claude’a do projektowania i rozwijania uzbrojenia, a także gromadzenia danych wywiadowczych oraz wspierania procesów zaopatrzeniowych związanych z programami zbrojeniowymi w Chinach, Rosji i Jemenie.

Anthropic poinformowało ponadto o wykryciu i zablokowaniu aktywności powiązanej z grupą ShinyHunters, jednym z najbardziej aktywnych kolektywów cyberprzestępczych.

Pocieszające jest tylko to, że żaden z incydentów opisanych w raporcie firmy nie dotyczył najpotężniejszego modelu AI firmy Anthropic – Claude Mythos.

Ten model tak skutecznie wykrywa luki w oprogramowaniu, że firma ściśle ograniczyła do niego dostęp, udostępniając go jedynie zaufanym partnerom, głównie z USA.


Śledź CrypS. w Google News. Czytaj najważniejsze wiadomości bezpośrednio w Google! Obserwuj ->

Zajrzyj na nasz telegram i dołącz do Crypto. Society. Dołącz ->