Grok može biti prevaren da otkrije podatke o korisniku

Vesti, 27.08.2026, 12:00 PM

Grok može biti prevaren da otkrije podatke o korisniku

Istraživači su demonstrirali novu tehniku prompt injection napada koja omogućava skrivanje zlonamernih instrukcija od zaštitnih mehanizama AI sistema tako što se one najpre šifruju, a zatim navede sam AI da ih dešifruje pomoću svojih alata. Nakon dešifrovanja, AI može da protumači skrivene instrukcije kao legitimne i izvrši ih.

Tehnika je nazvana Cryptographic Context Injection, a istraživači su je testirali na AI sistemima Grok i Gemini.

Prompt injection napadi zasnivaju se na tome da napadač sakrije instrukcije u sadržaju koji AI obrađuje, na primer na veb stranici, u dokumentu ili emailu. Kada korisnik zatraži od AI asistenta da pročita ili sažme takav sadržaj, model može da pogrešno protumači instrukcije napadača kao deo zadatka koji treba da izvrši.

Problem postoji zato što AI modeli ne mogu uvek pouzdano da razlikuju instrukcije koje dolaze od korisnika od instrukcija koje se nalaze u sadržaju koji obrađuju. AI kompanije zato koriste različite zaštitne mehanizme koji pokušavaju da prepoznaju i blokiraju ovakve pokušaje.

Cryptographic Context Injection uvodi još jedan korak. Umesto da zlonamerne instrukcije ostavi u čitljivom obliku, napadač ih šifruje. Zaštitni sistem zato u trenutku početne provere ne vidi instrukcije koje bi mogao da prepozna kao opasne.

AI se zatim navodi da pomoću svog alata za izvršavanje koda dešifruje sadržaj. Tek nakon toga skrivene instrukcije postaju čitljive.

Problem je u tome što su u tom trenutku već prošle početne bezbednosne provere, pa AI može da ih protumači kao legitimni deo konteksta i postupi prema njima.

Princip se može uporediti sa skrivanjem poruke na jeziku koji bezbednosna kontrola ne razume: poruka prođe kontrolu, a zatim je AI sam prevede i pročita.

Istraživači su tehniku testirali na Grok-u i Gemini-ju, ali rezultati nisu bili isti.

U slučaju Grok-a, prema istraživačima, bilo je moguće doći do podataka kao što su ime korisnika, približna lokacija, vrsta pretplate i istorija razgovora. Napad je mogao da bude pokrenut tokom naizgled bezazlenog zadatka, poput zahteva da AI sažme sadržaj određene veb stranice.

Kod Gemini-ja istraživači su tehniku koristili za zaobilaženje bezbednosnih ograničenja i generisanje sadržaja koji bi model u normalnim okolnostima odbio da napravi.

Istraživači nisu objavili sve tehničke detalje napada. Oni navode da su problem u Grok-u prijavili kompaniji xAI u junu 2026. godine, ali da kompanija nije preduzela odgovarajuće mere.

Google je, prema istraživačima, uveo poboljšanja zaštite Gemini-ja, ali problem još nije u potpunosti rešen.

Istraživanje ponovo ukazuje na problem koji postaje značajniji kako AI asistenti dobijaju pristup sve većem broju alata i podataka.

Prompt injection više ne mora samo da navede model da napiše nešto što ne bi trebalo. Ako AI može da pristupa internetu, izvršava kod ili koristi podatke korisnika, instrukcija sakrivena u sadržaju koji obrađuje može imati znatno ozbiljnije posledice.

Zbog toga korisnici treba da budu posebno oprezni kada AI asistentu daju pristup emailu, cloud servisima, repozitorijumima koda i drugim izvorima osetljivih podataka, kao i kada od njega traže da obrađuje nepoznate veb stranice, dokumente i linkove.


Prijavite se na našu mailing listu i primajte najnovije vesti (jednom dnevno) putem emaila svakog radnog dana besplatno:

Izdvojeno

Grok može biti prevaren da otkrije podatke o korisniku

Grok može biti prevaren da otkrije podatke o korisniku

Istraživači su demonstrirali novu tehniku prompt injection napada koja omogućava skrivanje zlonamernih instrukcija od zaštitnih mehanizama AI sist... Dalje

AI malver je sve češći, ali retko stiže do stvarnih korisnika

AI malver je sve češći, ali retko stiže do stvarnih korisnika

Istraživači Unit 42 kompanije Palo Alto Networks analizirali su više od 400 uzoraka malvera povezanih sa veštačkom inteligencijom i utvrdili da j... Dalje

Otkriveno 77 Firefox dodataka povezanih sa krađom kripto novčanika i lozinki

Otkriveno 77 Firefox dodataka povezanih sa krađom kripto novčanika i lozinki

Istraživači kompanije Socket otkrili su 77 međusobno povezanih dodataka za Firefox, među kojima je 40 dodataka za koje je potvrđeno da su zloname... Dalje

Malver WeedHack cilja Minecraft igrače preko Google pretrage

Malver WeedHack cilja Minecraft igrače preko Google pretrage

Malver WeedHack, koji je već zarazio više od 116.000 igrača Minecrafta, nastavio je da se širi i nakon što je u julu ugašena infrastruktura koju... Dalje

Otkriven prvi Android malver koji ciljano inficira multimedijalne sisteme u automobilima

Otkriven prvi Android malver koji ciljano inficira multimedijalne sisteme u automobilima

Novi Android malver koristi se za infekciju multimedijalnih sistema u automobilima i njihovo povezivanje u botnet, a zaraženi uređaji mogu biti isko... Dalje