OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika
Vesti, 19.08.2026, 14:00 PM
OpenAI je privremeno usporio treniranje nekih od svojih najnaprednijih AI modela kako bi unapredio bezbednosne mehanizme, nakon incidenta u kojem su njegovi AI agenti zaobišli zaštite i neovlašćeno pristupili platformi Hugging Face. Kompanija je najavila dvonedeljnu pauzu u delu treninga dok uvodi dodatne mere zaštite.
OpenAI je saopštio da se mogućnosti najnaprednijih AI modela ubrzano razvijaju i da sposobnost kompanije da ih razume i obezbedi mora da prati taj razvoj.
Pauza se ne odnosi na kompletan razvoj AI modela, već na deo treninga najnovijih modela koji koristi reinforcement learning (RL). Reč je o metodi tokom koje AI modeli uče na osnovu povratnih informacija, čime se poboljšava njihova sposobnost da izvršavaju zadatke i odgovaraju korisnicima.
Odluka je usledila nakon incidenta koji je OpenAI objavio 21. jula, kada su njegovi AI agenti tokom bezbednosnog eksperimenta uspeli da zaobiđu zaštitne mehanizme i dobiju neovlašćeni pristup platformi Hugging Face.
AI agenti su sistemi koji mogu samostalno da obavljaju zadatke nakon što dobiju početne instrukcije od čoveka.
OpenAI je incident opisao kao „do sada nezabeležen“. Naknadno je utvrđeno da su, pored Hugging Face-a, kompromitovane još tri neimenovane kompanije.
U nedeljama nakon prvobitne objave OpenAI-ja, kompanije Anthropic i Meta prijavile su slične incidente u kojima su njihovi AI sistemi tokom bezbednosnih testiranja uspeli da izvedu napade.
Izvršni direktor OpenAI-ja Sam Altman rekao je da je napredak modela sada „izuzetno brz“.
Prema njegovim rečima, kompanija je ranije najavljivala da će reagovati ukoliko sposobnosti AI modela počnu da napreduju brže od bezbednosnih mehanizama i mera kojima se kontroliše njihovo ponašanje.
Tokom dvonedeljne pauze OpenAI planira da proširi sisteme za praćenje potencijalno opasnog ponašanja modela i uvede dodatne bezbednosne provere pre nastavka treninga većeg obima.
Izdvojeno
Skrivena instrukcija napadača može da natera ChatGPT da krade podatke dok normalno odgovara korisniku
Jedna skrivena instrukcija ubačena u ChatGPT razgovor mogla je da natera AI asistenta da, dok korisniku normalno odgovara na pitanje, u pozadini izvr... Dalje
Google upozorava: Hakeri sve češće ciljaju AI alate za pisanje koda
Sve veća upotreba AI alata za pisanje koda stvorila je novu metu za sajber napade. Google Threat Intelligence Group (GTIG) upozorava da napadači sve... Dalje
Hakeri mogu da prisluškuju korisnike preko LG televizora čak i u standby režimu
Pametni televizori odavno nisu samo uređaji za gledanje programa. Povezani su na internet i kućnu mrežu, imaju aplikacije, reklamne sisteme, a neki... Dalje
Haker uz pomoć AI agenata izveo ransomware napad za samo 10 sati i žrtvi ostavio bezbednosni izveštaj
Ransomware napadač uspeo je da za manje od deset sati prodre duboko u mrežu jedne kompanije koristeći AI agente za automatizovanje velikog dela nap... Dalje
Kad promena lozinke ne pomaže: novi phishing napad omogućava hakerima trajni pristup nalogu
Hakeri koriste novu phishing tehniku pod nazivom „OAuth consent phishing“, kojom mogu da dobiju dugotrajan pristup nalozima žrtava bez kr... Dalje
Pratite nas
Nagrade






Pratite nas preko RSS-a





