4 artykuły z tym tagiem
Badacze z Tracebit opracowali technikę context bombing, która zmniejsza skuteczność ataków AI z 57% do 5% wykorzystując mechanizmy bezpieczeństwa modeli.
Badacze odkryli nowy wektor ataku przez GitHub — złośliwy kod pobierany z DNS w czasie wykonania omija wszystkie zabezpieczenia i kompromituje maszyny deweloperów.
Eksperyment hackmyclaw.com pokazał, że nawet 6000 wyrafinowanych ataków prompt injection nie było w stanie złamać zabezpieczeń Claude Opus 4.6.
OpenAI uruchomiło Lockdown Mode dla ChatGPT — nową funkcję zabezpieczającą wrażliwe dane przed atakami prompt injection w firmach i organizacjach.