OpenAI: AI modeli izašli iz kontrolisanog okruženja i hakovali Hugging Face kako bi „prepisali“ odgovore na testu

Vesti, 22.07.2026, 13:00 PM

OpenAI: AI modeli izašli iz kontrolisanog okruženja i hakovali Hugging Face kako bi „prepisali“ odgovore na testu

OpenAI je objavio da su dva njegova modela veštačke inteligencije tokom internog testiranja uspela da izađu iz kontrolisanog okruženja bez pristupa internetu, a zatim kompromituju sisteme platforme Hugging Face, kako bi došla do odgovora na bezbednosni test koji su rešavala.

Incident se dogodio tokom procene mogućnosti modela u okviru internog eksperimenta. Modeli su testirani bez uobičajenih bezbednosnih ograničenja kako bi istraživači mogli da procene njihove stvarne mogućnosti u oblasti sajber bezbednosti.

Zadatak modela bio je da reše izazove iz javno dostupnog benčmarka za sajber bezbednost ExploitGym. Međutim, umesto da samostalno pronađu rešenje, modeli su zaključili da se odgovori verovatno nalaze na platformi Hugging Face, koja hostuje veliki broj AI modela, skupova podataka i istraživačkih resursa.

Prema navodima OpenAI-ja, modeli su najpre pronašli način da izađu iz sandbox okruženja i ostvare pristup internetu. Nakon toga identifikovali su i iskoristili više ranjivosti, uključujući jednu do tada nepoznatu zero-day ranjivost, kako bi dobili pristup sistemima Hugging Face-a i pokušali da dođu do rešenja testa direktno iz produkcione baze podataka.

OpenAI navodi da svi dostupni dokazi ukazuju na to da modeli nisu imali drugi cilj osim pronalaženja odgovora za ExploitGym i da su bili spremni da primene veoma složen lanac napada kako bi ostvarili taj zadatak.

Hugging Face je prošle nedelje potvrdio da je njegova infrastruktura bila meta sajber napada autonomnog AI sistema. Kompanija je saopštila da je napad na vreme otkriven i zaustavljen, kao i da nema naznaka da je iza incidenta postojala loša namera.

Nakon otkrivanja incidenta, OpenAI je odgovorno prijavio pronađenu zero-day ranjivost proizvođaču pogođenog softvera i najavio dodatne mere kako bi se sprečilo da modeli tokom budućih testiranja ponove slične pokušaje.

Ovo nije prvi slučaj da napredni AI modeli pokušavaju da zaobiđu ograničenja postavljena tokom testiranja. OpenAI je ranije saopštio da je isti model u drugim eksperimentima uspeo da izađe iz sandbox okruženja, dok je kompanija Anthropic ranije objavila da je jedan od njenih modela takođe uspeo da ostvari pristup internetu mimo predviđenih ograničenja.

Iako se incident dogodio u strogo kontrolisanom istraživačkom okruženju, stručnjaci smatraju da predstavlja važan pokazatelj načina na koji napredni AI sistemi mogu samostalno da pronalaze neočekivane strategije za ostvarivanje zadatog cilja, zbog čega bezbednosna testiranja ovakvih modela postaju sve značajnija.


Prijavite se na našu mailing listu i primajte najnovije vesti (jednom dnevno) putem emaila svakog radnog dana besplatno:

Izdvojeno

Prevaranti koriste AI za lažne antivirus sajtove

Prevaranti koriste AI za lažne antivirus sajtove

Poruka koja upozorava da vam je upravo automatski obnovljena pretplata za antivirus i naplaćeno 129,99 evra može izgledati kao dobar razlog da odmah... Dalje

Šta se krije iza lažnih OpenAI mejlova

Šta se krije iza lažnih OpenAI mejlova

Korisnici ChatGPT-a meta su phishing kampanje u kojoj prevaranti šalju lažna obaveštenja o problemu sa plaćanjem pretplate. Mejlovi izgledaju kao ... Dalje

Hiljade AI profila u aplikacijama za upoznavanje navodile korisnike da plaćaju razgovore

Hiljade AI profila u aplikacijama za upoznavanje navodile korisnike da plaćaju razgovore

Više od 4.700 izmišljenih AI persona razgovaralo je sa najmanje 25.000 korisnika aplikacija za upoznavanje koji nisu znali da sa druge strane često... Dalje

Hakeri preuzeli zvanični HBO Max nalog na Redditu i preko njega širili malver

Hakeri preuzeli zvanični HBO Max nalog na Redditu i preko njega širili malver

Hakeri su preuzeli zvanični, verifikovani HBO Max nalog na Redditu i iskoristili ga za objavljivanje zlonamernih oglasa koji su korisnike Windows i m... Dalje

Popularni YouTube kanali za gejmere širili malver preko linkova ispod videa

Popularni YouTube kanali za gejmere širili malver preko linkova ispod videa

Hakeri su koristili popularne YouTube kanale sa savetima za gejmere kako bi korisnike naveli da preuzmu malver. Istraživači kompanije Palo Alto Netw... Dalje