OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika
Vesti, 19.08.2026, 14:00 PM
OpenAI je privremeno usporio treniranje nekih od svojih najnaprednijih AI modela kako bi unapredio bezbednosne mehanizme, nakon incidenta u kojem su njegovi AI agenti zaobišli zaštite i neovlašćeno pristupili platformi Hugging Face. Kompanija je najavila dvonedeljnu pauzu u delu treninga dok uvodi dodatne mere zaštite.
OpenAI je saopštio da se mogućnosti najnaprednijih AI modela ubrzano razvijaju i da sposobnost kompanije da ih razume i obezbedi mora da prati taj razvoj.
Pauza se ne odnosi na kompletan razvoj AI modela, već na deo treninga najnovijih modela koji koristi reinforcement learning (RL). Reč je o metodi tokom koje AI modeli uče na osnovu povratnih informacija, čime se poboljšava njihova sposobnost da izvršavaju zadatke i odgovaraju korisnicima.
Odluka je usledila nakon incidenta koji je OpenAI objavio 21. jula, kada su njegovi AI agenti tokom bezbednosnog eksperimenta uspeli da zaobiđu zaštitne mehanizme i dobiju neovlašćeni pristup platformi Hugging Face.
AI agenti su sistemi koji mogu samostalno da obavljaju zadatke nakon što dobiju početne instrukcije od čoveka.
OpenAI je incident opisao kao „do sada nezabeležen“. Naknadno je utvrđeno da su, pored Hugging Face-a, kompromitovane još tri neimenovane kompanije.
U nedeljama nakon prvobitne objave OpenAI-ja, kompanije Anthropic i Meta prijavile su slične incidente u kojima su njihovi AI sistemi tokom bezbednosnih testiranja uspeli da izvedu napade.
Izvršni direktor OpenAI-ja Sam Altman rekao je da je napredak modela sada „izuzetno brz“.
Prema njegovim rečima, kompanija je ranije najavljivala da će reagovati ukoliko sposobnosti AI modela počnu da napreduju brže od bezbednosnih mehanizama i mera kojima se kontroliše njihovo ponašanje.
Tokom dvonedeljne pauze OpenAI planira da proširi sisteme za praćenje potencijalno opasnog ponašanja modela i uvede dodatne bezbednosne provere pre nastavka treninga većeg obima.
Izdvojeno
OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika
OpenAI je privremeno usporio treniranje nekih od svojih najnaprednijih AI modela kako bi unapredio bezbednosne mehanizme, nakon incidenta u kojem su n... Dalje
Ranjivosti u Microsoft Copilotu omogućavaju krađu podataka korisnika jednim klikom
Istraživači kompanije Varonis otkrili su tri ranjivosti u Microsoft Copilot Personal koje su napadaču mogle da omoguće da jednim klikom korisnika ... Dalje
OpenAI uvodi ChatGPT za tinejdžere
OpenAI je počeo globalno da uvodi ChatGPT for Teens (ChatGPT za tinejdžere), namenjen korisnicima od 13 do 17 godina. Ako sistem proceni da korisnik... Dalje
Lažni TikTok sajtovi obećavaju novac koji korisnici nikada ne dobiju
Lažni sajtovi koji koriste TikTok logo obećavaju korisnicima novčane nagrade za svakodnevno prijavljivanje, obavljanje jednostavnih zadataka i pozi... Dalje
WhatsApp testira novu funkciju koja prepoznaje poruke prevaranata
WhatsApp je počeo da testira novu funkciju Scam Alert (Upozorenje o prevari) koja pomoću modela mašinskog učenja direktno na uređaju pokušava da... Dalje
Pratite nas
Nagrade






Pratite nas preko RSS-a





