Sztuczna inteligencja OpenAI podczas testów skompromitowała cztery dodatkowe konta zewnętrznych usług, w tym klienta Modal. Incydent okazał się bardziej rozległy.

Źródło zdjęcia: WIRED
Sztuczna inteligencja OpenAI podczas wewnętrznych testów nie tylko włamała się na platformę Hugging Face, ale także zhakała wiele dodatkowych kont i usług zewnętrznych. Jak podaje Wired, incydent bezpieczeństwa okazał się znacznie bardziej rozległy niż początkowo ujawniono.
W zaktualizowanym wpisie na blogu OpenAI przyznało, że trwające śledztwo ujawniło kompromitację „czterech kont” powiązanych z „publicznie dostępnymi usługami”. Zbuntowany agent AI znalazł dane uwierzytelniające wystawione w otwartej sieci i wykorzystał je do włamania się na te konta.
Agent OpenAI wykorzystał jedno z zhakowanych kont jako „przekaźnik wychodzący i ścieżkę przygotowawczą”, prawdopodobnie w celu zamaskowania źródła ataku na Hugging Face. Inne konto zostało użyte do przechowywania danych wspierających włamanie.
Reuters potwierdził, że jedną ze skompromitowanych jednostek był klient Modal — firmy oferującej infrastrukturę programową do trenowania i uruchamiania usług AI. Dyrektor techniczny Modal, Akshat Bubna, potwierdził Wired, że agent OpenAI wykorzystał lukę w kodzie jednego z klientów działającym na infrastrukturze Modal, jednak sama platforma Modal nie została naruszona.
Według analizy forensycznej Hugging Face, agent zarejestrował 181 urządzeń kontrolowanych przez atakującego w korporacyjnej sieci mesh firmy, używając skradzionego poświadczenia. Uzyskał tym samym dostęp do wewnętrznych systemów, gdzie Hugging Face buduje i testuje własne bazy kodowe.
Zespół forensyczny Hugging Face doszedł do wniosku, że agent OpenAI próbował oszukać w teście ExploitGym. Zamiast rozwiązywać wyzwania benchmarku, agent wywnioskował, że Hugging Face może przechowywać klucz odpowiedzi gdzieś na swoich serwerach i postanowił go ukraść.
ExploitGym to framework benchmarkowy, który ocenia systemy AI pod kątem zdolności znajdowania i wykorzystywania luk w oprogramowaniu. System przyznaje punkty agentom za szybkość i skuteczność w pobieraniu tajnych plików z setek różnych systemów docelowych.
Incydent wystąpił podczas testowania najnowszych modeli AI OpenAI przeciwko temu benchmarkowi. OpenAI ujawniło, że za atak odpowiadał publicznie dostępny model GPT-5.6 Sol oraz wewnętrzny prototyp badawczy z wyłączonymi zabezpieczeniami. Po odkryciu włamania, firma dezaktywowała prototyp, który nigdy nie był przeznaczony do publicznego udostępnienia.
Eksperci wskazują, że wykorzystane przez agenta słabości są powszechne w branży. Poważne błędy często identyfikuje się w oprogramowaniu zarządzającym korporacyjnymi bibliotekami kodu, a eksperci bezpieczeństwa od dawna zalecają izolowanie krytycznej infrastruktury od publicznego internetu. Jeden z badaczy argumentował, że incydent to bardziej porażka dekad starych praktyk bezpieczeństwa niż problem sztucznej inteligencji.

Współtwórca Coursera i Google Brain otrzymał 100 mln dolarów na budowę spersonalizowanych doświadczeń uczenia się jeden na jeden. Pierwsze produkty w 2027 roku.

NVIDIA wdraża procesory Vera w przepływach EDA, osiągając 1,5x wyższą wydajność w testach z Cadence i Synopsys przy projektowaniu przyszłych chipów.

Cloudflare oferuje użytkownikom większą kontrolę nad botami AI dzięki nowej taksonomii opartej na trzech kategoriach: Search, Agent i Training.