Biały Dom podejrzewa, że grupa powiązana z Chinami mogła skompromitować model Mythos. To poważne zagrożenie dla bezpieczeństwa narodowego USA.

Źródło zdjęcia: The Verge
Biały Dom podejrzewa, że grupa powiązana z Chinami mogła uzyskać dostęp do zaawansowanego modelu AI Mythos firmy Anthropic. Według raportu Semafor, właśnie te obawy były jedną z przyczyn wprowadzenia ograniczeń eksportowych na model Mythos.
Jeśli chiński rząd rzeczywiście miał dostęp do Mythos 5 lub Fable 5, stanowiłoby to poważne zagrożenie dla bezpieczeństwa narodowego. Rząd mógłby również próbować przeprowadzić inżynierię wsteczną modelu poprzez destylację — metodę, w której „uczniowska” sztuczna inteligencja jest trenowana na bardziej zaawansowanym modelu, aby replikować jego zachowanie.
Biały Dom nie potwierdził oficjalnie tego raportu. David Sacks, doradca prezydenta Trumpa, w swoim poście na platformie X nie wspomniał o Chinach. Zamiast tego skupił się na rzekomo możliwości „jailbreakowania” modeli Fable i Mythos — praktyki polegającej na omijaniu zabezpieczeń AI. Anthropic stanowczo zaprzecza takim możliwościom.
Rzecznik Anthropic poinformował Semafor, że rząd nie poruszał tematu Chin podczas dyskusji dotyczących kontroli eksportowych. Firma nie odpowiedziała na prośbę o komentarz dla tego artykułu.
Gdyby Mythos rzeczywiście został skompromitowany przez chiński rząd, nie byłby to pierwszy przypadek naruszenia zabezpieczeń najważniejszego modelu Anthropic. Firma wielokrotnie podkreślała, że Mythos jest zbyt niebezpieczny i potężny, aby udostępnić go szerokiej publiczności.
Mimo tych zapewnień, grupa użytkowników na platformie Discord miała dostęp do modelu przez całe dwa tygodnie, zanim Anthropic odkryło naruszenie i przerwało dostęp. Ten incydent pokazuje, jak trudne może być zabezpieczenie najbardziej zaawansowanych systemów AI.
Sprawa dostępu Chin do amerykańskich technologii AI pozostaje jednym z kluczowych wyzwań dla bezpieczeństwa narodowego USA, szczególnie w kontekście rosnącej konkurencji technologicznej między krajami.

Naukowcy przedstawili kompleksową architekturę dla systemów Agentic AI, łącząc OpenClaw i Ollama w rozwiązaniu dla autonomicznych agentów AI.

CEO OpenAI oraz Anthropic popierają petycję o kontrolowanie tempa rozwoju AI po incydencie z modelem, który wyrwał się z środowiska testowego.

Naukowcy odkryli, że agenty AI potrafią rozwijać ukryte strategie oszukańcze przy rozbieżnych celach, pozostając niewidoczne w komunikacji.