OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika

Vesti, 19.08.2026, 14:00 PM

OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika

OpenAI je privremeno usporio treniranje nekih od svojih najnaprednijih AI modela kako bi unapredio bezbednosne mehanizme, nakon incidenta u kojem su njegovi AI agenti zaobišli zaštite i neovlašćeno pristupili platformi Hugging Face. Kompanija je najavila dvonedeljnu pauzu u delu treninga dok uvodi dodatne mere zaštite.

OpenAI je saopštio da se mogućnosti najnaprednijih AI modela ubrzano razvijaju i da sposobnost kompanije da ih razume i obezbedi mora da prati taj razvoj.

Pauza se ne odnosi na kompletan razvoj AI modela, već na deo treninga najnovijih modela koji koristi reinforcement learning (RL). Reč je o metodi tokom koje AI modeli uče na osnovu povratnih informacija, čime se poboljšava njihova sposobnost da izvršavaju zadatke i odgovaraju korisnicima.

Odluka je usledila nakon incidenta koji je OpenAI objavio 21. jula, kada su njegovi AI agenti tokom bezbednosnog eksperimenta uspeli da zaobiđu zaštitne mehanizme i dobiju neovlašćeni pristup platformi Hugging Face.

AI agenti su sistemi koji mogu samostalno da obavljaju zadatke nakon što dobiju početne instrukcije od čoveka.

OpenAI je incident opisao kao „do sada nezabeležen“. Naknadno je utvrđeno da su, pored Hugging Face-a, kompromitovane još tri neimenovane kompanije.

U nedeljama nakon prvobitne objave OpenAI-ja, kompanije Anthropic i Meta prijavile su slične incidente u kojima su njihovi AI sistemi tokom bezbednosnih testiranja uspeli da izvedu napade.

Izvršni direktor OpenAI-ja Sam Altman rekao je da je napredak modela sada „izuzetno brz“.

Prema njegovim rečima, kompanija je ranije najavljivala da će reagovati ukoliko sposobnosti AI modela počnu da napreduju brže od bezbednosnih mehanizama i mera kojima se kontroliše njihovo ponašanje.

Tokom dvonedeljne pauze OpenAI planira da proširi sisteme za praćenje potencijalno opasnog ponašanja modela i uvede dodatne bezbednosne provere pre nastavka treninga većeg obima.


Prijavite se na našu mailing listu i primajte najnovije vesti (jednom dnevno) putem emaila svakog radnog dana besplatno:

Izdvojeno

Skrivena instrukcija napadača može da natera ChatGPT da krade podatke dok normalno odgovara korisniku

Skrivena instrukcija napadača može da natera ChatGPT da krade podatke dok normalno odgovara korisniku

Jedna skrivena instrukcija ubačena u ChatGPT razgovor mogla je da natera AI asistenta da, dok korisniku normalno odgovara na pitanje, u pozadini izvr... Dalje

Google upozorava: Hakeri sve češće ciljaju AI alate za pisanje koda

Google upozorava: Hakeri sve češće ciljaju AI alate za pisanje koda

Sve veća upotreba AI alata za pisanje koda stvorila je novu metu za sajber napade. Google Threat Intelligence Group (GTIG) upozorava da napadači sve... Dalje

Hakeri mogu da prisluškuju korisnike preko LG televizora čak i u standby režimu

Hakeri mogu da prisluškuju korisnike preko LG televizora čak i u standby režimu

Pametni televizori odavno nisu samo uređaji za gledanje programa. Povezani su na internet i kućnu mrežu, imaju aplikacije, reklamne sisteme, a neki... Dalje

Haker uz pomoć AI agenata izveo ransomware napad za samo 10 sati i žrtvi ostavio bezbednosni izveštaj

Haker uz pomoć AI agenata izveo ransomware napad za samo 10 sati i žrtvi ostavio bezbednosni izveštaj

Ransomware napadač uspeo je da za manje od deset sati prodre duboko u mrežu jedne kompanije koristeći AI agente za automatizovanje velikog dela nap... Dalje

Kad promena lozinke ne pomaže: novi phishing napad omogućava hakerima trajni pristup nalogu

Kad promena lozinke ne pomaže: novi phishing napad omogućava hakerima trajni pristup nalogu

Hakeri koriste novu phishing tehniku pod nazivom „OAuth consent phishing“, kojom mogu da dobiju dugotrajan pristup nalozima žrtava bez kr... Dalje