Claude pomagał w tworzeniu broni autonomicznej

Firma Anthropic opublikowała raport, który rzuca światło na niepokojące zastosowania swojego chatbota Claude. Dokument opisuje przypadki, w których podmioty powiązane z Rosją, Chinami, Jemenem oraz Iranem wykorzystywały model jako narzędzie wspomagające prace inżynieryjne nad systemami uzbrojenia. To jeden z pierwszych tak szczegółowych przeglądów nadużyć komercyjnego modelu AI w kontekście militarnym.

Anthropic podkreśla, że wszystkie opisane działania wykryła w ramach własnych wewnętrznych dochodzeń. Konta zaangażowane w te operacje zostały zablokowane, a zabezpieczenia modelu wzmocnione. Firma zaznacza również, że część informacji przekazała właściwym organom państwowym.

Rosyjski zespół projektował autonomiczne drony bojowe

Jednym z najbardziej szczegółowo opisanych przypadków jest działalność niewielkiej, wyspecjalizowanej grupy rosyjskich aktorów powiązanych z uczelnią regionalną, a nie z państwowym podmiotem. Zespół ten wykorzystywał Claude do stworzenia kluczowego oprogramowania dla dronów, w tym mechanizmu współdzielonej pamięci roju oraz logiki koordynacji odpornej na awarie pojedynczych jednostek.

Od kodu ataku po terminalne naprowadzanie

Oprócz podstawowej architektury systemu, aktorzy opracowali również moduły odpowiedzialne za zachowania ofensywne, obserwację oraz powrót do bazy. Osobny element stanowił system naprowadzania terminalnego, którego zadaniem było kierowanie dronów w stronę wyznaczonych celów. Całość uzupełniały komponenty pozwalające na wykorzystanie bezzałogowców przeciwko operatorom przeciwnika.

Kluczowy i zarazem najbardziej alarmujący element dotyczył autonomii. Zbudowane oprogramowanie potrafiło samodzielnie wybierać cele i wydawać polecenia ataku, bez konieczności zatwierdzania decyzji przez człowieka. Anthropic określił ten projekt jako platformę zaprojektowaną do autonomicznego prowadzenia śmiertelnych działań. Model pokładowy miał zarówno identyfikować obiekty, jak i inicjować detonację bez udziału operatora w pętli decyzyjnej.

Rosyjski zespół, nazwany przez Anthropic operacją „freelance”, opracował także narzędzie trenowane na zebranych materiałach z ukraińskiego pola walki. Jego zadaniem było rozróżnianie własnych i wrogich środków. Jako demonstracyjny punkt uderzenia wybrano stałą współrzędną w rejonie Doniecka.

Firma zidentyfikowała dziewięć kont powiązanych z tym procederem. Aktorzy obchodzili ograniczenia geograficzne, kierując ruch przez komercyjne serwery VPN. Konta powstały między końcem 2025 a początkiem 2026 roku, a operacje rozpoczęły się w maju.

Chiny, Jemen i Iran – trzy odrębne kierunki nadużyć

Raport nie ogranicza się do jednego regionu. Anthropic opisał również aktywność podmiotu powiązanego z Chinami, który wykorzystywał Claude do prac nad systemem uzbrojenia przeciwtorpedowego. Celem było przygotowanie propozycji dla marynarki wojennej ChRL.

Ponad 200 stron specyfikacji i symulacja recenzenta

Model posłużył do napisania chińskojęzycznych specyfikacji technicznych systemu kierowania ogniem przeciw torpedom. Powstał dokument liczący ponad 200 stron, a także prezentacja dla kadry zarządzającej. Aktorzy porównywali własny projekt z konkretnymi programami amerykańskimi, opierając się na publicznie dostępnych informacjach. Co ciekawe, wykorzystali Claude również do odgrywania roli wrogiego recenzenta, który miał wyłapać słabe punkty koncepcji.

Osobny wątek dotyczył innego użytkownika z Chin, który sięgał po Claude w celu gromadzenia informacji o broni skierowanej energii. Anthropic wykrył tę aktywność w ramach wewnętrznych kontroli i zablokował konto.

Jemeńska komórka inżynieryjna i test rakietowy

Trzeci przypadek dotyczy operacji inżynierii uzbrojenia w północnym Jemenie, na terenach kontrolowanych w dużej mierze przez wspieranych przez Iran Huti. Zespół ten korzystał z Claude Code do zadań, które normalnie wykonywaliby ludzcy programiści. Sesje koncentrowały się na oprogramowaniu do naprowadzania, nawigacji i sterowania rakietami oraz pociskami.

Aktorzy używali modelu do przeprowadzania symulacji i diagnozowania usterek. Anthropic zaznacza, że nie ma dowodów na to, by udało się wdrożyć w pełni działające urządzenie, ale potwierdza, że doszło do testowego wystrzelenia rakiety kierowanej. Próba najprawdopodobniej zakończyła się niepowodzeniem – w ciągu kilku godzin zespół wrócił do Claude, by ustalić przyczyny awarii.

Iran i dane o amerykańskich siłach morskich

Czwarty opisany przypadek to aktywność podmiotu o nieokreślonych powiązaniach z Iranem. Ten aktor wykorzystywał Claude do zbierania i analizowania publicznie dostępnych informacji w celu opracowania rekomendacji dotyczących celów uderzeń przeciwko siłom USA.

Zgromadzone materiały obejmowały listę amerykańskiego personelu wojskowego, pozyskaną z podpisów pod publicznymi fotografiami wojskowymi. Wśród danych znalazły się również identyfikatory transponderów okrętów i samolotów dostępne publicznie, skrypty do zapytań o komercyjne zdjęcia satelitarne oraz wykaz stron internetowych ujawniających ruchy marynarki wojennej USA.

Anthropic poinformował, że zablokował konto, przekazał ustalenia władzom i opracował mechanizmy wykrywania podobnych nadużyć w przyszłości.

Kontekst branżowy i pytania o granice

Publikacja raportu zbiega się z szerszą debatą o bezpieczeństwie zaawansowanych modeli AI. Kilka dni przed jego ujawnieniem badacz Jacob Coxon odszedł z Anthropic w geście protestu przeciwko wyścigowi zbrojeń w rozwoju sztucznej inteligencji. W poście na platformie X ostrzegał, że osoby budujące AI szczerze wierzą, iż technologia ta może doprowadzić do zagłady ludzkości jeszcze przed końcem dekady.

Raport Anthropic pokazuje, że modele językowe stają się narzędziami o realnym potencjale militarnym – nie w teorii, lecz w praktyce. Nawet jeśli część prób kończy się niepowodzeniem, sam fakt sięgania po komercyjne AI do projektowania systemów uzbrojenia rodzi pytania o skuteczność obecnych zabezpieczeń. Firmy technologiczne, rządy i społeczność badawcza stoją przed wyzwaniem wypracowania mechanizmów, które nie zahamują rozwoju AI, ale ograniczą ryzyko jej wykorzystania w sposób wymykający się jakiejkolwiek kontroli.

Źródło