OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika

Vesti, 19.08.2026, 14:00 PM

OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika

OpenAI je privremeno usporio treniranje nekih od svojih najnaprednijih AI modela kako bi unapredio bezbednosne mehanizme, nakon incidenta u kojem su njegovi AI agenti zaobišli zaštite i neovlašćeno pristupili platformi Hugging Face. Kompanija je najavila dvonedeljnu pauzu u delu treninga dok uvodi dodatne mere zaštite.

OpenAI je saopštio da se mogućnosti najnaprednijih AI modela ubrzano razvijaju i da sposobnost kompanije da ih razume i obezbedi mora da prati taj razvoj.

Pauza se ne odnosi na kompletan razvoj AI modela, već na deo treninga najnovijih modela koji koristi reinforcement learning (RL). Reč je o metodi tokom koje AI modeli uče na osnovu povratnih informacija, čime se poboljšava njihova sposobnost da izvršavaju zadatke i odgovaraju korisnicima.

Odluka je usledila nakon incidenta koji je OpenAI objavio 21. jula, kada su njegovi AI agenti tokom bezbednosnog eksperimenta uspeli da zaobiđu zaštitne mehanizme i dobiju neovlašćeni pristup platformi Hugging Face.

AI agenti su sistemi koji mogu samostalno da obavljaju zadatke nakon što dobiju početne instrukcije od čoveka.

OpenAI je incident opisao kao „do sada nezabeležen“. Naknadno je utvrđeno da su, pored Hugging Face-a, kompromitovane još tri neimenovane kompanije.

U nedeljama nakon prvobitne objave OpenAI-ja, kompanije Anthropic i Meta prijavile su slične incidente u kojima su njihovi AI sistemi tokom bezbednosnih testiranja uspeli da izvedu napade.

Izvršni direktor OpenAI-ja Sam Altman rekao je da je napredak modela sada „izuzetno brz“.

Prema njegovim rečima, kompanija je ranije najavljivala da će reagovati ukoliko sposobnosti AI modela počnu da napreduju brže od bezbednosnih mehanizama i mera kojima se kontroliše njihovo ponašanje.

Tokom dvonedeljne pauze OpenAI planira da proširi sisteme za praćenje potencijalno opasnog ponašanja modela i uvede dodatne bezbednosne provere pre nastavka treninga većeg obima.


Prijavite se na našu mailing listu i primajte najnovije vesti (jednom dnevno) putem emaila svakog radnog dana besplatno:

Izdvojeno

OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika

OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika

OpenAI je privremeno usporio treniranje nekih od svojih najnaprednijih AI modela kako bi unapredio bezbednosne mehanizme, nakon incidenta u kojem su n... Dalje

Ranjivosti u Microsoft Copilotu omogućavaju krađu podataka korisnika jednim klikom

Ranjivosti u Microsoft Copilotu omogućavaju krađu podataka korisnika jednim klikom

Istraživači kompanije Varonis otkrili su tri ranjivosti u Microsoft Copilot Personal koje su napadaču mogle da omoguće da jednim klikom korisnika ... Dalje

OpenAI uvodi ChatGPT za tinejdžere

OpenAI uvodi ChatGPT za tinejdžere

OpenAI je počeo globalno da uvodi ChatGPT for Teens (ChatGPT za tinejdžere), namenjen korisnicima od 13 do 17 godina. Ako sistem proceni da korisnik... Dalje

Lažni TikTok sajtovi obećavaju novac koji korisnici nikada ne dobiju

Lažni TikTok sajtovi obećavaju novac koji korisnici nikada ne dobiju

Lažni sajtovi koji koriste TikTok logo obećavaju korisnicima novčane nagrade za svakodnevno prijavljivanje, obavljanje jednostavnih zadataka i pozi... Dalje

WhatsApp testira novu funkciju koja prepoznaje poruke prevaranata

WhatsApp testira novu funkciju koja prepoznaje poruke prevaranata

WhatsApp je počeo da testira novu funkciju Scam Alert (Upozorenje o prevari) koja pomoću modela mašinskog učenja direktno na uređaju pokušava da... Dalje