Anthropic: Claude AI tokom testiranja dospeo do interneta u tri incidenta i kompromitovao stvarne sisteme

Vesti, 31.07.2026, 14:30 PM

Anthropic: Claude AI tokom testiranja dospeo do interneta u tri incidenta i kompromitovao stvarne sisteme

Kompanija Anthropic saopštila je da je tokom interne analize otkrila tri slučaja u kojima su njeni Claude AI modeli, zbog greške u testnom okruženju, dobili pristup internetu i kompromitovali sisteme trećih strana.

Incidenti, koji datiraju iz aprila ove godine, odnose se na modele Claude Opus 4.7, Claude Mythos 5 i jedan interni istraživački model. Kompanija navodi da su ovi incidenti otkriveni nakon pregleda više od 141.000 testiranja sprovedenih nakon sličnih otkrića koje je prošle nedelje objavio OpenAI.

Sva tri slučaja dogodila su se tokom takozvanih capture-the-flag testova, namenjenih proceni sajber sposobnosti AI modela. Iako je Claude bio upućen da se nalazi u simuliranom okruženju bez pristupa internetu, zbog nesporazuma između Anthropic-a i partnera koji je sprovodio testiranje modeli su ipak dobili pristup stvarnoj mreži.

U najozbiljnijem incidentu Claude Opus 4.7 povezao je naziv iz zamišljenog scenarija sa stvarnim internet domenom, pribavio pristupne podatke i pristupio bazi koja je sadržala produkcione podatke.

U drugom slučaju Claude Mythos 5 napravio je zlonamerni Python paket i postavio ga na PyPI, gde je bio dostupan oko sat vremena. Paket je preuzet i pokrenut na 15 stvarnih sistema, a u jednom slučaju omogućio je krađu akreditiva i dalji pristup resursima kompanije.

Treći model kompromitovao je javno dostupnu aplikaciju koristeći poznate tehnike napada, uključujući SQL injection i pristup podacima sa nezaštićene debug stranice.

Anthropic navodi da su svi incidenti brzo zaustavljeni i poziva druge AI kompanije da provere sopstvena testna okruženja kako bi se sprečilo da slične greške omoguće AI modelima pristup stvarnim sistemima.


Prijavite se na našu mailing listu i primajte najnovije vesti (jednom dnevno) putem emaila svakog radnog dana besplatno:

Izdvojeno

Prevaranti koriste AI za lažne antivirus sajtove

Prevaranti koriste AI za lažne antivirus sajtove

Poruka koja upozorava da vam je upravo automatski obnovljena pretplata za antivirus i naplaćeno 129,99 evra može izgledati kao dobar razlog da odmah... Dalje

Šta se krije iza lažnih OpenAI mejlova

Šta se krije iza lažnih OpenAI mejlova

Korisnici ChatGPT-a meta su phishing kampanje u kojoj prevaranti šalju lažna obaveštenja o problemu sa plaćanjem pretplate. Mejlovi izgledaju kao ... Dalje

Hiljade AI profila u aplikacijama za upoznavanje navodile korisnike da plaćaju razgovore

Hiljade AI profila u aplikacijama za upoznavanje navodile korisnike da plaćaju razgovore

Više od 4.700 izmišljenih AI persona razgovaralo je sa najmanje 25.000 korisnika aplikacija za upoznavanje koji nisu znali da sa druge strane često... Dalje

Hakeri preuzeli zvanični HBO Max nalog na Redditu i preko njega širili malver

Hakeri preuzeli zvanični HBO Max nalog na Redditu i preko njega širili malver

Hakeri su preuzeli zvanični, verifikovani HBO Max nalog na Redditu i iskoristili ga za objavljivanje zlonamernih oglasa koji su korisnike Windows i m... Dalje

Popularni YouTube kanali za gejmere širili malver preko linkova ispod videa

Popularni YouTube kanali za gejmere širili malver preko linkova ispod videa

Hakeri su koristili popularne YouTube kanale sa savetima za gejmere kako bi korisnike naveli da preuzmu malver. Istraživači kompanije Palo Alto Netw... Dalje