Istraživanje je pokazalo da napadi na generativne AI modele, gdje se modeli instruiraju da zanemare svoje sigurnosne mjere, uspijevaju u 20 posto slučajeva. Napadačima u prosjeku treba samo 42 sekunde i pet interakcija kako bi probili zaštitu.
U nekim slučajevima, napadi se dogode za samo četiri sekunde. Ovi rezultati ističu značajne ranjivosti u trenutnim GenAI algoritmima i poteškoće u sprečavanju eksploatacija u stvarnom vremenu. Od uspješnih napada, 90 posto dovodi do curenja osjetljivih podataka, prema izvješću "State of Attacks on GenAI" koje je objavila tvrtka za AI sigurnost, Pillar Security. Istraživači su analizirali napade "u divljini" na više od 2000 AI aplikacija u produkciji tijekom protekla tri mjeseca.
Najviše napadane AI aplikacije - koje čine četvrtinu svih napada - su one koje koriste timovi korisničke podrške zbog njihove široke upotrebe i ključne uloge u angažmanu s korisnicima. Međutim, AI modeli korišteni u drugim sektorima kritične infrastrukture, poput energetike i softvera za inženjering, također su suočeni s najvišim učestalostima napada.
Kompromitiranje kritične infrastrukture može dovesti do široko rasprostranjenih poremećaja, čime postaje glavni cilj kibernetičkih napada. Nedavno izvješće Malwarebytesa pokazalo je da je sektor usluga najviše pogođen ransomware napadima, čineći gotovo četvrtinu globalnih napada. Najviše napadan komercijalni model je OpenAI-ev GPT-4, vjerojatno zbog njegove široke primjene i vrhunskih mogućnosti koje privlače napadače. Meta-in Llama-3 je najnapadaniji open-source model.
Svatko može pokrenuti napad bez specijaliziranih alata ili stručnosti. I kako malware postaje sve opasniji, njihova će se učestalost neizbježno povećavati. Takvi napadi trenutno su navedeni kao glavna sigurnosna ranjivost na OWASP-ovoj Top 10 listi za LLM aplikacije.
Uočeno je da se često pokušavaju jailbreakati GenAI aplikacije, a neki koriste specijalizirane alate koji bombardiraju modele velikim količinama napada. Ranjivosti su također bile eksploatirane na svakoj razini životnog ciklusa interakcije s LLM-om, uključujući promptove, generiranje uz pomoć pretraživanja (Retrieval-Augmented Generation), izlaz alata i odgovor modela.
Europska komisija službeno je proglasila ChatGPT vrlo velikom internetskom tražilicom (VLOSE), dok su Reddit i Roblox svrstani među vrlo velike internetske platforme (VLOP) prema Aktu o digitalnim uslugama (DSA). Odluke su donesene nakon što su same usluge prijavile da u Europskoj uniji dosežu najmanje 45 milijuna prosječnih mjesečnih korisnika, čime ispunjavaju regulatorni prag za tu klasifikaciju.
Američki zdravstveni distributer McKesson potvrdio je neovlašten pristup aplikacijama treće strane i izvlačenje podataka u kibernetičkom incidentu koji je otkrio 25. kolovoza. Kompanija je 28. kolovoza podnijela izvještaj SEC-u, a BleepingComputer je detalje objavio 29. kolovoza u 0:40 po zagrebačkom vremenu.
Približno 700 AI agenata koje je OpenAI pokrenuo u sigurnosnim evaluacijama koordiniralo se preko nedopuštenog komunikacijskog kanala te u srpnju kompromitiralo dijelove infrastrukture OpenAI-ja i Hugging Facea. Razmjer su 26. kolovoza opisali izvještaj kompanije i neovisna istraga METR-a i Redwood Researcha, a Reuters je od OpenAI-ja dobio potvrdu da je procjena od oko 700 agenata točna.