Wojsko USA przygotowywało się do przechwycenia i wejścia na pokład chińskiego statku na podstawie raportu wywiadowczego stworzonego z pomocą AI. Jak podał Ars Technica za CNN, urzędnicy zatrzymali operację, gdy odkryli, że chatbot błędnie rozpoznał przewożony materiał. Przypadek pokazuje, jak fałszywa odpowiedź modelu może wpłynąć na decyzje dotyczące bezpieczeństwa międzynarodowego.
Błędny raport uruchomił przygotowania do abordażu
Według czterech źródeł CNN zaznajomionych ze sprawą raport złożył analityk US Special Operations Command, czyli dowództwa operacji specjalnych USA. Dokument wskazywał, że chiński statek transportuje przez Bliski Wschód komponenty przeznaczone do programu broni jądrowej.
Na podstawie raportu amerykańskie wojsko przygotowywało przechwycenie jednostki i wejście na jej pokład. W planach znalazło się również wsparcie lotnicze. Zanim rozpoczęto operację, urzędnicy ustalili, że chatbot wykorzystany podczas opracowywania raportu nieprawidłowo zidentyfikował ładunek statku.
Jedno ze źródeł CNN oceniło, że incydent "niemal rozpoczął wojnę". Materiał nie podaje nazwy statku, miejsca planowanego przechwycenia ani dokładnej daty zdarzenia. Nie wskazuje też, jakie materiały jednostka rzeczywiście przewoziła.
Chatbot połączył otwarte źródła z tajnymi danymi
Analityk użył chatbota do analizy raportów wywiadowczych dotyczących manifestu ładunkowego chińskiego statku. Narzędzie połączyło informacje z otwartych źródeł, określane jako OSINT, z niejawnym wywiadem sygnałowym, czyli SIGINT, znajdującym się w zasobach administracji USA.
Na tej podstawie powstał raport, który trafił do wojskowego procesu decyzyjnego. Z relacji nie wynika, czy chatbot sam sformułował kluczowe twierdzenie o komponentach programu jądrowego, czy też błędnie powiązał informacje, które następnie rozwinął analityk. Wiadomo jedynie, że urzędnicy uznali identyfikację ładunku dokonaną przez narzędzie za całkowicie fałszywą.
- Dane wejściowe: raporty dotyczące manifestu ładunkowego oraz informacje wywiadowcze z różnych źródeł.
- Przetwarzanie: chatbot zestawił OSINT z tajnymi danymi SIGINT przechowywanymi przez administrację.
- Wynik: raport wskazał na transport komponentów programu broni jądrowej.
- Reakcja: wojsko zaczęło przygotowywać przechwycenie statku ze wsparciem lotniczym.
- Korekta: urzędnicy wykryli błędną identyfikację przed rozpoczęciem abordażu.
To przykład halucynacji AI, czyli wygenerowania informacji, której nie potwierdzają dane źródłowe. Ars Technica przypomina, że podobne błędy pojawiały się wcześniej w pracy autorów, dziennikarzy, naukowców, sędziów, lekarzy, policji i firmowych centrów obsługi. W 2023 roku Cambridge Dictionary uznał angielski czasownik związany z halucynowaniem przez AI za słowo roku.
Nadzór człowieka nie zatrzymał błędu na pierwszym etapie
Opisywany przypadek pokazuje ograniczenie zasady human in the loop, czyli udziału człowieka w procesie decyzyjnym. Raport przygotował i przekazał analityk, a mimo to błędna informacja przeszła na etap planowania działań wojskowych. Dopiero późniejsza kontrola przeprowadzona przez urzędników przerwała ten ciąg zdarzeń.
Źródło nie wyjaśnia, jakie procedury weryfikacji obowiązywały analityka ani kto zatwierdził raport. Nie wiadomo również, czy odbiorcy dokumentu otrzymali informację, że podczas jego tworzenia wykorzystano generatywną AI. Brakuje też danych o tym, w jaki sposób wykryto pomyłkę i czy sprawdzono inne raporty przygotowane tym samym narzędziem.
W 2023 roku Departament Stanu USA opublikował Declaration on Responsible Military Use of Artificial Intelligence and Autonomy. Dokument wskazywał, że wojsko powinno rozważać ryzyko i korzyści, ograniczać niezamierzone uprzedzenia oraz zapobiegać wypadkom. Odpowiedzialne użycie AI miało zawsze obejmować człowieka w procesie oraz jasno określony łańcuch dowodzenia i kontroli.
Badacze przywołani przez Ars Technica sugerują jednak, że całkowite wyeliminowanie halucynacji dużych modeli językowych może być niemożliwe. Proste polecenia nakazujące modelowi, aby nie podawał fałszywych informacji, nie rozwiązują problemu wiarygodności wyników.
Pentagon rozszerza dostęp do generatywnej AI
Incydent wydarzył się w okresie szybkiego zwiększania skali wykorzystania AI przez amerykański Departament Obrony. W styczniu 2026 roku resort przedstawił strategię przyspieszenia prac nad AI. Zakładała ona udostępnianie odpowiednich danych ze sfederowanych systemów IT do wykorzystania przez sztuczną inteligencję, w tym danych z systemów misyjnych poszczególnych rodzajów sił zbrojnych.
Defense Secretary Pete Hegseth uzasadniał tę strategię zależnością jakości AI od jakości dostarczanych danych. Opisywany raport wskazuje jednak, że dostęp do większej liczby źródeł nie usuwa ryzyka błędnego połączenia informacji. W tym przypadku chatbot miał zestawić materiały otwarte z tajnym wywiadem sygnałowym, lecz wyprowadził z nich nieprawidłowy wniosek o ładunku statku.
W grudniu 2025 roku Departament Obrony ogłosił, że Google Gemini for Government stanie się podstawą jego platformy GenAI.mil. W sierpniu 2026 roku do platformy dodano Grok for Government. Anthropic oferuje natomiast dostosowaną wersję Claude przeznaczoną do pracy amerykańskiego wywiadu.
W czerwcu 2026 roku przedstawiciel Pentagonu poinformował Kongres, że generatywna AI pomaga tworzyć raporty wymagane przez Kongres. Według tej samej wypowiedzi z wojskowych narzędzi generatywnej AI skorzystało 1,5 mln aktywnych członków personelu Departamentu Obrony.
Spór o granice takich zastosowań dotyczy również broni autonomicznej. W marcu 2026 roku Departament Obrony umieścił Anthropic na czarnej liście z powodu sprzeciwu firmy wobec używania jej modeli w autonomicznych systemach uzbrojenia. W sierpniu 2026 roku sędzia federalny uznał ten krok za bezprawny odwet naruszający Pierwszą Poprawkę.
Przypadek podważa zaufanie do raportów tworzonych z AI
Najważniejszym problemem nie jest wyłącznie pojedyncza fałszywa odpowiedź chatbota. Błąd został umieszczony w profesjonalnym raporcie i wpłynął na przygotowania do działania zbrojnego. Dopiero kolejny etap kontroli pozwolił ustalić, że informacja o ładunku była nieprawdziwa.
Ars Technica opisuje zdarzenie na tle szerszej debaty o bezpieczeństwie AI. Ostrzeżenia badaczy dotyczące najbardziej dotkliwych skutków rozwoju systemów generatywnych zwiększyły zainteresowanie regulacjami oraz koordynowaniem tempa badań prowadzonych przez czołowe laboratoria AI. Jednocześnie instytucje wojskowe rozwijają zastosowania modeli w analizie informacji, raportowaniu i systemach autonomicznych.
Dla firm w Polsce opisany przypadek stanowi ostrzeżenie przed automatycznym przenoszeniem odpowiedzi modelu do procesów, które uruchamiają działania o dużych konsekwencjach. Gdy AI łączy dokumenty wewnętrzne z danymi zewnętrznymi, kontrola powinna obejmować nie tylko końcowy tekst, lecz także zgodność kluczowych twierdzeń z materiałami źródłowymi.
Relacja nie ujawnia nazwy użytego chatbota, konfiguracji systemu ani treści poleceń przekazanych modelowi. Nie pozwala więc ocenić, czy główną przyczyną była konstrukcja narzędzia, jakość danych, sposób użycia przez analityka czy nieskuteczna procedura weryfikacji. Pewne jest jedynie, że nieprawdziwy wynik dotarł wystarczająco daleko, aby wojsko rozpoczęło przygotowania do przechwycenia statku.
