Anthropic: Claude AI tokom testiranja dospeo do interneta u tri incidenta i kompromitovao stvarne sisteme
Vesti, 31.07.2026, 14:30 PM
Kompanija Anthropic saopštila je da je tokom interne analize otkrila tri slučaja u kojima su njeni Claude AI modeli, zbog greške u testnom okruženju, dobili pristup internetu i kompromitovali sisteme trećih strana.
Incidenti, koji datiraju iz aprila ove godine, odnose se na modele Claude Opus 4.7, Claude Mythos 5 i jedan interni istraživački model. Kompanija navodi da su ovi incidenti otkriveni nakon pregleda više od 141.000 testiranja sprovedenih nakon sličnih otkrića koje je prošle nedelje objavio OpenAI.
Sva tri slučaja dogodila su se tokom takozvanih capture-the-flag testova, namenjenih proceni sajber sposobnosti AI modela. Iako je Claude bio upućen da se nalazi u simuliranom okruženju bez pristupa internetu, zbog nesporazuma između Anthropic-a i partnera koji je sprovodio testiranje modeli su ipak dobili pristup stvarnoj mreži.
U najozbiljnijem incidentu Claude Opus 4.7 povezao je naziv iz zamišljenog scenarija sa stvarnim internet domenom, pribavio pristupne podatke i pristupio bazi koja je sadržala produkcione podatke.
U drugom slučaju Claude Mythos 5 napravio je zlonamerni Python paket i postavio ga na PyPI, gde je bio dostupan oko sat vremena. Paket je preuzet i pokrenut na 15 stvarnih sistema, a u jednom slučaju omogućio je krađu akreditiva i dalji pristup resursima kompanije.
Treći model kompromitovao je javno dostupnu aplikaciju koristeći poznate tehnike napada, uključujući SQL injection i pristup podacima sa nezaštićene debug stranice.
Anthropic navodi da su svi incidenti brzo zaustavljeni i poziva druge AI kompanije da provere sopstvena testna okruženja kako bi se sprečilo da slične greške omoguće AI modelima pristup stvarnim sistemima.
Izdvojeno
Prevaranti koriste AI za lažne antivirus sajtove
Poruka koja upozorava da vam je upravo automatski obnovljena pretplata za antivirus i naplaćeno 129,99 evra može izgledati kao dobar razlog da odmah... Dalje
Šta se krije iza lažnih OpenAI mejlova
Korisnici ChatGPT-a meta su phishing kampanje u kojoj prevaranti šalju lažna obaveštenja o problemu sa plaćanjem pretplate. Mejlovi izgledaju kao ... Dalje
Hiljade AI profila u aplikacijama za upoznavanje navodile korisnike da plaćaju razgovore
Više od 4.700 izmišljenih AI persona razgovaralo je sa najmanje 25.000 korisnika aplikacija za upoznavanje koji nisu znali da sa druge strane često... Dalje
Hakeri preuzeli zvanični HBO Max nalog na Redditu i preko njega širili malver
Hakeri su preuzeli zvanični, verifikovani HBO Max nalog na Redditu i iskoristili ga za objavljivanje zlonamernih oglasa koji su korisnike Windows i m... Dalje
Popularni YouTube kanali za gejmere širili malver preko linkova ispod videa
Hakeri su koristili popularne YouTube kanale sa savetima za gejmere kako bi korisnike naveli da preuzmu malver. Istraživači kompanije Palo Alto Netw... Dalje
Pratite nas
Nagrade






Pratite nas preko RSS-a





