
Link: https://www.ictbusiness.info / internet / anthropic-otkrio-zloupotrebe-claudea
Anthropic otkrio zloupotrebe Claudea
Anthropic je identificirao više pokušaja u kojima su akteri povezani s Rusijom, Kinom, Iranom i Jemenom nastojali zloupotrijebiti njegove modele Claude za aktivnosti koje uključuju razvoj oružja, kibernetički nadzor i digitalne napade. Aktivnosti su otkrivene i praćene tijekom prethodnih osam mjeseci u sklopu kontinuiranog praćenja prijetnji koje provodi tvrtkin tim za obavještajne analitike prijetnji.
U novom izvješću Anthropic navodi slučajeve zloupotrebe otkrivene između prosinca 2025. i kolovoza 2026., među kojima su prijevare, financijske prevare, biološka zloupotreba, razvoj konvencionalnog oružja, nadzor, kibernetičke operacije i pokušaji neovlaštenog izdvajanja znanja iz modela. U najvećem broju slučajeva korišteni su modeli iz obitelji Claude Haiku, Sonnet i Opus, dok se modeli Fable ili Mythos pojavljuju samo u jednom slučaju nedopuštene distilacije modela. Anthropic tvrdi da je njegov specijalizirani sigurnosni tim prekinuo svaku operaciju opisanu u izvješću.
Među nalazima je pet slučajeva potencijalne biološke zloupotrebe. Jedan od njih odnosio se na pokušaj istraživača koje Anthropic opisuje kao državno sponzorirane virologe da uz pomoć modela rade na naprednijoj inačici virusa chikungunya, koji prenose komarci. Tvrtka pritom naglašava da su biološki slučajevi često dvosmisleni i da dio aktivnosti može imati legitimnu istraživačku svrhu, zbog čega samo korištenje modela nije dokaz zlonamjerne namjere.
Izvješće opisuje i ruske aktere koji su pokušavali razviti softver za autonomni roj FPV dronova namijenjenih napadima, pri čemu su za obuku sustava koristili snimke borbenih djelovanja iz Ukrajine. Akteri iz sjevernog Jemena koristili su Claude u pokušajima razvoja softverskih komponenti za različite vrste projektila, no Anthropic navodi da nema dokaza da je takav rad rezultirao funkcionalnim operativnim sustavom.
Zaseban dio izvješća bavi se nadzorom i profiliranjem pojedinaca. Akteri povezani s Kinom i Iranom pokušavali su koristiti modele za praćenje i obradu podataka o osobama, a u jednom slučaju operacija povezana s Kinom koristila je AI za praćenje, profiliranje i pokušaje regrutiranja Ujgura unutar Sirijske vojske.
Posebno se izdvaja slučaj konzultanta za kojeg Anthropic vjeruje da je radio za jednu obavještajnu službu u Maliju. Prema izvješću, Claude je korišten kao važan dio razvoja platforme sposobne za obradu podataka povezanih s približno 25 milijuna SIM kartica u toj zemlji. Anthropic je korisnički račun zabranio, ali navodi da je platforma do tog trenutka već bila uvedena u lokalno operativno okruženje.
Tvrtka poručuje da opisani slučajevi ne predstavljaju tipičnu uporabu njezinih modela, nego novije i neuobičajene obrasce prijetnji koje je do sada zabilježila. Objavljivanjem podataka želi drugim proizvođačima AI sustava, sigurnosnim timovima i državnim institucijama olakšati prepoznavanje novih obrazaca zloupotrebe i jačanje zajedničkih obrambenih mehanizama.
Anthropicovo izvješće pokazuje kako se sigurnosni problem generativnog AI-ja sve manje svodi samo na pojedinačne štetne upite, a sve više na korištenje modela unutar dugih, višekoračnih radnih procesa. Tvrtka je u rujnu 2026. objavila da je između prosinca 2025. i kolovoza 2026. prekidala aktivnosti u sedam različitih kategorija štete. U tim slučajevima modeli su ponekad služili kao pomoć pri pisanju koda, analizi podataka i koordinaciji zadataka, što povećava važnost nadzora nad ponašanjem agenata tijekom cijelog procesa, a ne samo nad pojedinačnim odgovorom modela.
Anthropic naglašava da objavljeni primjeri nisu reprezentativni za uobičajenu uporabu Claudea, nego su odabrani upravo zato što predstavljaju nove ili neuobičajene prijetnje. Slučaj iz Malija posebno je važan jer pokazuje da se AI može pokušati ugraditi u već postojeće sustave masovnog nadzora. Prema Anthropicovu izvješću, sustav je bio usmjeren na sva tri nacionalna mobilna operatora i približno 25 milijuna SIM kartica. Tvrtka zato kombinira zabrane korisničkih računa, sigurnosne filtre i vlastitu obavještajne analitike prijetnji analitiku kako bi otkrila obrasce koji se ne mogu prepoznati iz jednog zahtjeva.
Razvoj sve sposobnijih agentskih sustava dodatno povećava potrebu za neovisnim testiranjem modela, evidencijom incidenata i razmjenom pokazatelja prijetnji među pružateljima AI usluga. Sigurnosni izazov pritom nije ograničen samo na velike modele, jer se specijalizirani alati mogu povezivati u lance u kojima svaki pojedini korak izgleda legitimno. Za telekom i IT sektor posebno je važna činjenica da AI može ubrzati obradu velikih skupova podataka, automatizirati izviđanje sustava i smanjiti količinu ručnog rada potrebnog napadaču. Zbog toga će zaštita infrastrukture sve više ovisiti o kombinaciji klasične kibernetičke sigurnosti, nadzora AI agenata i pravila koja jasno određuju koje se operacije smiju automatizirati.
