Anthropic: Claude AI tokom testiranja dospeo do interneta u tri incidenta i kompromitovao stvarne sisteme
Vesti, 31.07.2026, 14:30 PM
Kompanija Anthropic saopštila je da je tokom interne analize otkrila tri slučaja u kojima su njeni Claude AI modeli, zbog greške u testnom okruženju, dobili pristup internetu i kompromitovali sisteme trećih strana.
Incidenti, koji datiraju iz aprila ove godine, odnose se na modele Claude Opus 4.7, Claude Mythos 5 i jedan interni istraživački model. Kompanija navodi da su ovi incidenti otkriveni nakon pregleda više od 141.000 testiranja sprovedenih nakon sličnih otkrića koje je prošle nedelje objavio OpenAI.
Sva tri slučaja dogodila su se tokom takozvanih capture-the-flag testova, namenjenih proceni sajber sposobnosti AI modela. Iako je Claude bio upućen da se nalazi u simuliranom okruženju bez pristupa internetu, zbog nesporazuma između Anthropic-a i partnera koji je sprovodio testiranje modeli su ipak dobili pristup stvarnoj mreži.
U najozbiljnijem incidentu Claude Opus 4.7 povezao je naziv iz zamišljenog scenarija sa stvarnim internet domenom, pribavio pristupne podatke i pristupio bazi koja je sadržala produkcione podatke.
U drugom slučaju Claude Mythos 5 napravio je zlonamerni Python paket i postavio ga na PyPI, gde je bio dostupan oko sat vremena. Paket je preuzet i pokrenut na 15 stvarnih sistema, a u jednom slučaju omogućio je krađu akreditiva i dalji pristup resursima kompanije.
Treći model kompromitovao je javno dostupnu aplikaciju koristeći poznate tehnike napada, uključujući SQL injection i pristup podacima sa nezaštićene debug stranice.
Anthropic navodi da su svi incidenti brzo zaustavljeni i poziva druge AI kompanije da provere sopstvena testna okruženja kako bi se sprečilo da slične greške omoguće AI modelima pristup stvarnim sistemima.
Izdvojeno
OpenAI usporava treniranje najnaprednijih AI modela zbog bezbednosnih rizika
OpenAI je privremeno usporio treniranje nekih od svojih najnaprednijih AI modela kako bi unapredio bezbednosne mehanizme, nakon incidenta u kojem su n... Dalje
Ranjivosti u Microsoft Copilotu omogućavaju krađu podataka korisnika jednim klikom
Istraživači kompanije Varonis otkrili su tri ranjivosti u Microsoft Copilot Personal koje su napadaču mogle da omoguće da jednim klikom korisnika ... Dalje
OpenAI uvodi ChatGPT za tinejdžere
OpenAI je počeo globalno da uvodi ChatGPT for Teens (ChatGPT za tinejdžere), namenjen korisnicima od 13 do 17 godina. Ako sistem proceni da korisnik... Dalje
Lažni TikTok sajtovi obećavaju novac koji korisnici nikada ne dobiju
Lažni sajtovi koji koriste TikTok logo obećavaju korisnicima novčane nagrade za svakodnevno prijavljivanje, obavljanje jednostavnih zadataka i pozi... Dalje
WhatsApp testira novu funkciju koja prepoznaje poruke prevaranata
WhatsApp je počeo da testira novu funkciju Scam Alert (Upozorenje o prevari) koja pomoću modela mašinskog učenja direktno na uređaju pokušava da... Dalje
Pratite nas
Nagrade






Pratite nas preko RSS-a





