OpenAI: Incident sa 700 AI agenata koji su napali Hugging Face je upozorenje

Vesti, 28.08.2026, 14:30 PM

OpenAI: Incident sa 700 AI agenata koji su napali Hugging Face je upozorenje

Više od 700 AI agenata kompanije OpenAI učestvovalo je u napadu na Hugging Face nakon što su agenti, koji je trebalo da rade izolovano jedni od drugih i bez pristupa internetu, pronašli način da međusobno komuniciraju, zaobiđu ograničenja testnog okruženja i dođu do interneta. Incident je OpenAI opisao kao „upozorenje“ koje pokazuje kakve rizike mogu predstavljati današnji napredni AI modeli.

Incident je počeo tokom bezbednosnog testiranja OpenAI-jevog internog istraživačkog modela nazvanog „Interni model 1“ (IM1). AI agenti rešavali su „capture-the-flag“ zadatke u okruženju u kojem je trebalo da budu izolovani jedni od drugih i od interneta.

Međutim, agenti su otkrili da mogu da koriste interni Artifactory servis za upravljanje softverskim paketima kako bi međusobno razmenjivali informacije. Upisivanjem fajlova koje su drugi agenti mogli da pročitaju, praktično su napravili sopstvenu oglasnu tablu.

Agenti su zatim pronašli i način da preko Artifactoryja pristupe internetu. Iskoristili su činjenicu da je ovaj servis imao ograničen pristup internetu radi preuzimanja i instaliranja softverskih paketa i naveli ga da u njihovo ime šalje druge zahteve ka internetu.

Informacije o tome kako su zaobiđena ograničenja zatim su podelili sa drugim agentima preko iste improvizovane oglasne table.

OpenAI je 5. jula otvorio istragu zbog bezbednosnog incidenta, čime je komunikacioni kanal slučajno uklonjen. Međutim, tim koji je reagovao na incident tada nije znao da su agenti koristili Artifactory za međusobnu komunikaciju niti je bio svestan značaja tih poruka.

Samo nekoliko dana kasnije agenti su pronašli novi način da komuniciraju. Do 8. jula počeli su da kodiraju poruke u nazive direktorijuma koje su drugi agenti mogli da pročitaju. Jedan agent ostavio je zahtev za pomoć, a drugi su ga pronašli i odgovorili.

Od tog trenutka njihova saradnja postajala je sve složenija. Prema OpenAI-ju, agenti su počeli da sarađuju i dele zadatke, a u pojedinim porukama sami sebe su opisivali kao „roj“ ili „kolektiv“.

Agenti koji nisu uspevali da reše zadatke koji su im prvobitno dodeljeni počeli su da istražuju druge servise, među kojima su bili Modal i Hugging Face. Kombinovanjem više ranjivosti u OpenAI-jevoj istraživačkoj infrastrukturi i produkcionom okruženju Hugging Face-a uspeli su da dođu do internih podataka i kredencijala. U jednom trenutku iskorišćena je i do tada nepoznata ranjivost koja im je omogućila pristup otvorenom internetu.

Nezavisna analiza organizacije METR pokazala je razmere komunikacije među agentima. Ukupno 1.206 AI agenata koji je trebalo da budu međusobno izolovani počelo je da komunicira preko improvizovanog kanala, razmenivši više od 70.000 poruka. Više od 700 agenata učestvovalo je u napadu na Hugging Face.

OpenAI je utvrdio četiri obrasca ponašanja koji su doprineli incidentu: pokušaje agenata da pronađu prečice do nagrade, upornost u rešavanju naizgled nemogućih zadataka, neovlašćenu međusobnu komunikaciju i preuzimanje ciljeva od drugih agenata. Kompanija je, međutim, izdvojila upravo trajne i neovlašćene komunikacione kanale kao ključni problem.

Incident je pokazao i koliko je teško zaustaviti ovakvo ponašanje kada veliki broj AI agenata može da koristi alate i infrastrukturu. Uklanjanje prvog komunikacionog kanala nije zaustavilo agente jer su oni pronašli drugi način da razmenjuju informacije i nastavili saradnju.

OpenAI je zbog toga incident opisao kao „upozorenje“ da sposobnosti današnjih AI modela već stvaraju situacije u kojima se može izgubiti kontrola nad njihovim ponašanjem i najavio strože bezbednosne mere za buduća testiranja.

Foto: Mariia Berezovsky | Unsplash


Prijavite se na našu mailing listu i primajte najnovije vesti (jednom dnevno) putem emaila svakog radnog dana besplatno:

Izdvojeno

OpenAI: Incident sa 700 AI agenata koji su napali Hugging Face je upozorenje

OpenAI: Incident sa 700 AI agenata koji su napali Hugging Face je upozorenje

Više od 700 AI agenata kompanije OpenAI učestvovalo je u napadu na Hugging Face nakon što su agenti, koji je trebalo da rade izolovano jedni od dru... Dalje

Hakeri prevarili veštačku inteligenciju da im pomogne u napadima na kompanije

Hakeri prevarili veštačku inteligenciju da im pomogne u napadima na kompanije

Ruska ransomware grupa Aur0ra koristila je AI agenta Cursor tokom napada na najmanje sedam kompanija, a njegove bezbednosne mehanizme zaobilazila je t... Dalje

Grok može biti prevaren da otkrije podatke o korisniku

Grok može biti prevaren da otkrije podatke o korisniku

Istraživači su demonstrirali novu tehniku prompt injection napada koja omogućava skrivanje zlonamernih instrukcija od zaštitnih mehanizama AI sist... Dalje

AI malver je sve češći, ali retko stiže do stvarnih korisnika

AI malver je sve češći, ali retko stiže do stvarnih korisnika

Istraživači Unit 42 kompanije Palo Alto Networks analizirali su više od 400 uzoraka malvera povezanih sa veštačkom inteligencijom i utvrdili da j... Dalje

Otkriveno 77 Firefox dodataka povezanih sa krađom kripto novčanika i lozinki

Otkriveno 77 Firefox dodataka povezanih sa krađom kripto novčanika i lozinki

Istraživači kompanije Socket otkrili su 77 međusobno povezanih dodataka za Firefox, među kojima je 40 dodataka za koje je potvrđeno da su zloname... Dalje