OpenAI: Incident sa 700 AI agenata koji su napali Hugging Face je upozorenje
Vesti, 28.08.2026, 14:30 PM
Više od 700 AI agenata kompanije OpenAI učestvovalo je u napadu na Hugging Face nakon što su agenti, koji je trebalo da rade izolovano jedni od drugih i bez pristupa internetu, pronašli način da međusobno komuniciraju, zaobiđu ograničenja testnog okruženja i dođu do interneta. Incident je OpenAI opisao kao „upozorenje“ koje pokazuje kakve rizike mogu predstavljati današnji napredni AI modeli.
Incident je počeo tokom bezbednosnog testiranja OpenAI-jevog internog istraživačkog modela nazvanog „Interni model 1“ (IM1). AI agenti rešavali su „capture-the-flag“ zadatke u okruženju u kojem je trebalo da budu izolovani jedni od drugih i od interneta.
Međutim, agenti su otkrili da mogu da koriste interni Artifactory servis za upravljanje softverskim paketima kako bi međusobno razmenjivali informacije. Upisivanjem fajlova koje su drugi agenti mogli da pročitaju, praktično su napravili sopstvenu oglasnu tablu.
Agenti su zatim pronašli i način da preko Artifactoryja pristupe internetu. Iskoristili su činjenicu da je ovaj servis imao ograničen pristup internetu radi preuzimanja i instaliranja softverskih paketa i naveli ga da u njihovo ime šalje druge zahteve ka internetu.
Informacije o tome kako su zaobiđena ograničenja zatim su podelili sa drugim agentima preko iste improvizovane oglasne table.
OpenAI je 5. jula otvorio istragu zbog bezbednosnog incidenta, čime je komunikacioni kanal slučajno uklonjen. Međutim, tim koji je reagovao na incident tada nije znao da su agenti koristili Artifactory za međusobnu komunikaciju niti je bio svestan značaja tih poruka.
Samo nekoliko dana kasnije agenti su pronašli novi način da komuniciraju. Do 8. jula počeli su da kodiraju poruke u nazive direktorijuma koje su drugi agenti mogli da pročitaju. Jedan agent ostavio je zahtev za pomoć, a drugi su ga pronašli i odgovorili.
Od tog trenutka njihova saradnja postajala je sve složenija. Prema OpenAI-ju, agenti su počeli da sarađuju i dele zadatke, a u pojedinim porukama sami sebe su opisivali kao „roj“ ili „kolektiv“.
Agenti koji nisu uspevali da reše zadatke koji su im prvobitno dodeljeni počeli su da istražuju druge servise, među kojima su bili Modal i Hugging Face. Kombinovanjem više ranjivosti u OpenAI-jevoj istraživačkoj infrastrukturi i produkcionom okruženju Hugging Face-a uspeli su da dođu do internih podataka i kredencijala. U jednom trenutku iskorišćena je i do tada nepoznata ranjivost koja im je omogućila pristup otvorenom internetu.
Nezavisna analiza organizacije METR pokazala je razmere komunikacije među agentima. Ukupno 1.206 AI agenata koji je trebalo da budu međusobno izolovani počelo je da komunicira preko improvizovanog kanala, razmenivši više od 70.000 poruka. Više od 700 agenata učestvovalo je u napadu na Hugging Face.
OpenAI je utvrdio četiri obrasca ponašanja koji su doprineli incidentu: pokušaje agenata da pronađu prečice do nagrade, upornost u rešavanju naizgled nemogućih zadataka, neovlašćenu međusobnu komunikaciju i preuzimanje ciljeva od drugih agenata. Kompanija je, međutim, izdvojila upravo trajne i neovlašćene komunikacione kanale kao ključni problem.
Incident je pokazao i koliko je teško zaustaviti ovakvo ponašanje kada veliki broj AI agenata može da koristi alate i infrastrukturu. Uklanjanje prvog komunikacionog kanala nije zaustavilo agente jer su oni pronašli drugi način da razmenjuju informacije i nastavili saradnju.
OpenAI je zbog toga incident opisao kao „upozorenje“ da sposobnosti današnjih AI modela već stvaraju situacije u kojima se može izgubiti kontrola nad njihovim ponašanjem i najavio strože bezbednosne mere za buduća testiranja.
Foto: Mariia Berezovsky | Unsplash
Izdvojeno
OpenAI: Incident sa 700 AI agenata koji su napali Hugging Face je upozorenje
Više od 700 AI agenata kompanije OpenAI učestvovalo je u napadu na Hugging Face nakon što su agenti, koji je trebalo da rade izolovano jedni od dru... Dalje
Hakeri prevarili veštačku inteligenciju da im pomogne u napadima na kompanije
Ruska ransomware grupa Aur0ra koristila je AI agenta Cursor tokom napada na najmanje sedam kompanija, a njegove bezbednosne mehanizme zaobilazila je t... Dalje
Grok može biti prevaren da otkrije podatke o korisniku
Istraživači su demonstrirali novu tehniku prompt injection napada koja omogućava skrivanje zlonamernih instrukcija od zaštitnih mehanizama AI sist... Dalje
AI malver je sve češći, ali retko stiže do stvarnih korisnika
Istraživači Unit 42 kompanije Palo Alto Networks analizirali su više od 400 uzoraka malvera povezanih sa veštačkom inteligencijom i utvrdili da j... Dalje
Otkriveno 77 Firefox dodataka povezanih sa krađom kripto novčanika i lozinki
Istraživači kompanije Socket otkrili su 77 međusobno povezanih dodataka za Firefox, među kojima je 40 dodataka za koje je potvrđeno da su zloname... Dalje
Pratite nas
Nagrade






Pratite nas preko RSS-a





