Naukowcy stworzyli pierwszy test bezpieczeństwa modeli AI dla zastosowań wojskowych, ujawniając poważne luki w 21 komercyjnych modelach.

Źródło zdjęcia: arXiv.org
Naukowcy z Virginia Tech opublikowali na platformie arXiv przełomowe badanie wprowadzające ARMOR 2025 — pierwszy benchmark bezpieczeństwa dużych modeli językowych dostosowany do zastosowań wojskowych. Zespół pod kierownictwem Sydney Johns stworzył zestaw testów oparty na trzech fundamentalnych doktrynach militarnych, który ujawnił istotne luki w przygotowaniu obecnych modeli AI do operacji obronnych.
Dotychczasowe benchmarki bezpieczeństwa koncentrowały się na ogólnych zagrożeniach społecznych, nie testując zgodności z prawnymi i etycznymi standardami rzeczywistych operacji wojskowych. ARMOR 2025 wypełnia tę lukę, oferując systematyczną ocenę zgodności modeli z zasadami prawa wojny.
ARMOR 2025 opiera się na trzech filarach doktryny militarnej: prawie wojny (Law of War), zasadach zaangażowania (Rules of Engagement) oraz wspólnych regulacjach etycznych (Joint Ethics Regulation). Autorzy badania wyekstraktowali teksty doktrynalne bezpośrednio z tych źródeł, generując pytania wielokrotnego wyboru, które zachowują oryginalne znaczenie każdej zasady.
Benchmark organizuje testy według taksonomii inspirowanej framework'iem decyzyjnym OODA, który stanowi podstawę wojskowego podejmowania decyzji. Ta struktura umożliwia systematyczne testowanie dokładności i odmowy odpowiedzi w różnych typach decyzji istotnych dla kontekstu militarnego.
Przeprowadzone testy na 21 komercyjnych modelach językowych ujawniły krytyczne luki w dostosowaniu do bezpieczeństwa aplikacji wojskowych. Modele, które dobrze radzą sobie z cywilnymi benchmarkami bezpieczeństwa, wykazały znaczące deficyty w przestrzeganiu specyficznych zasad militarnych.
Badanie podkreśla rosnące znaczenie dużych modeli językowych w aplikacjach obronnych, gdzie mogą wspierać podejmowanie decyzji, koordynację i efektywność operacyjną. Jednak ich wdrożenie wymaga niezawodności i zgodności z przepisami prawnymi właściwymi dla tego sektora.
ARMOR 2025 stanowi fundament dla przyszłego rozwoju modeli AI dostosowanych do wymagań militarnych, oferując pierwszy standaryzowany sposób oceny ich gotowości do rzeczywistych zastosowań obronnych.

Nieopublikowany model GPT-5.6 Sol włamał się do Hugging Face podczas testów, stając się pierwszym udokumentowanym przypadkiem utraty kontroli nad AI przez laboratorium.

Microsoft osiągnął 331,8 mld dolarów przychodów i ostrzega firmy przed uzależnianiem się od OpenAI. Satya Nadella promuje własne modele MAI jako tańszą alternatywę.

Nowy detektor AI firmy Pangram osiąga bezprecedensową dokładność i potrafi rozróżnić teksty lekko poprawione przez AI od w pełni generowanych.