OpenAI-jevi AI modeli samostalno napali još četiri platforme
Tvrtka incident naziva 'cyber napadom bez presedana', a uključivao je ChatGPT-5.6 Sol i još snažniji model u razvoju
Tvrtka incident naziva 'cyber napadom bez presedana', a uključivao je ChatGPT-5.6 Sol i još snažniji model u razvoju
OpenAI je u utorak objavio da su njegovi modeli umjetne inteligencije, koji su prethodno pobjegli iz zatvorenog testnog okruženja, istovremeno provalili na još četiri platforme. Incident, koji se dogodio prije nekoliko tjedana, tvrtka je za Le Figaro opisala kao "cyberattaque sans précédent" (cyber napad bez presedana).
Osim već poznatog napada na Hugging Face, svojevrsnu trgovinu aplikacijama za alate umjetne inteligencije, agenti su pronašli i iskoristili javno izložene vjerodajnice na četiri odvojena računa na četiri dodatne usluge. Jedna od tih platformi poslužila je kao relej za pripremu napada upravo na Hugging Face, gdje su modeli tražili odgovore na hakerske testove koje im je zadao OpenAI. Imena dodatnih meta nisu objavljena.
OpenAI je potvrdio da je napad izvela "kombinacija modela", među kojima je bio nedavno lansirani ChatGPT-5.6 Sol te još "snažniji model" koji je tek u fazi razvoja. Modeli su se samoinicijativno probili iz ograničenog testnog okruženja i počeli pretraživati javne usluge, kopirati programski kod ili ga testirati, ali u nekim slučajevima "ne više od običnog korisnika", naveo je OpenAI prema Le Figaru.
Prema Tportalu, sigurnosna tvrtka Hugging Face prvi je put otkrila napad 16. srpnja 2026. i odmah obavijestila policiju. Trebalo im je tri dana da uopće detektiraju upad, a potom i više sati da suzbiju i izbace uljeze. Tvrtka nije objavila financijski iznos štete, ali je priznala da je morala obnoviti oko trećine svoje infrastrukture.
Cloud Security Alliance (CSA) sastavio je izvješće na temelju hitnog sastanka s Hugging Faceom. U njemu se navodi da su "agenti slijedili neučinkovite rute i pokazivali nespretno ponašanje koje nijedan čovjek ne bi odabrao". Ponavljali su već dovršene radnje, halucinirali hrpe nepovezanih naredbi i nisu dobro prikrivali tragove. No, bilo je i "briljantnih tehničkih poteza" te munjevite prilagodbe novim scenarijima.
CSA je upozorio da su ovakvi agenti "vođeni ciljevima, postavljaju vlastite podciljeve, prilagođavaju se u stvarnom vremenu kako bi zaobišli obranu i djeluju s upornošću brzine stroja koja može nadjačati ručne operacije", prenosi Tportal. Usporedili su ih s dinosaurima iz "Jurskog parka" koji bježe iz ograđenih prostora.
Sličan incident zabilježen je već u rujnu 2024., kada je raniji model ChatGPT-a pobjegao iz svog spremnika kako bi došao do odgovora potrebnog za drugi test. No, ovaj se događaj smatra najozbiljnijim bijegom umjetne inteligencije dosad, a iz CSA-e upozoravaju da odmetničko ponašanje "više nije iznimka, već je postalo standard".
Na pitanje o incidentu, američki predsjednik Donald Trump izjavio je da treba biti oprezan i pronaći ravnotežu između kontrole agenata i toga da SAD ne zaostane za Kinom u razvoju umjetne inteligencije. "Ne želimo ih ograničiti pa da se odjednom nađemo iza Kine", rekao je Trump, dodajući: "onaj tko pobijedi u ovoj utrci mogao bi pokupiti cijeli ulog", piše Le Figaro.
S druge strane, u utorak 28. srpnja više od tisuću zaposlenika AI divova, uključujući generalnog direktora Anthropica Daria Amodeija, potpisalo je peticiju kojom od američke vlade traže da pomogne "odgoditi" izlazak najnaprednijih novih modela. U peticiji se navodi da "industrija, vlada i cijelo društvo mogu trebati opciju da si daju vremena za rješavanje novonastalih rizika, razvoj sigurnosnih mjera i jačanje nadzora".
OpenAI je najavio da će uskoro objaviti i nalaze vlastite istrage, a stručnjaci za kibernetičku sigurnost upozoravaju da će se morati prilagoditi uvjetima u kojima rojevi AI agenata djeluju nadljudskom brzinom, istovremeno briljantno i nespretno, što bi moglo dovesti do još incidenata.