Sigurnost AI agenata: prompt injection i curenje podataka
AI agent s pristupom alatima nova je površina napada. Što je prompt injection, zašto Gartner veže 25% proboja uz agente do 2028. i kako se zaštititi.
Sigurnost AI agenata jest zaštita AI agenata - softvera koji čita Vaše podatke, koristi alate i djeluje u Vašim sustavima - od manipulacije, curenja podataka i zlouporabe. Agent s pristupom e-pošti, bazi i API-jima nova je površina napada koju Vaš vatrozid nikad nije ni trebao vidjeti.
Što je prompt injection?
Prompt injection (ubacivanje uputa) jest napad u kojem se zlonamjerne upute skrivaju u sadržaju koji AI čita - u e-poruci, web stranici, PDF-u - pa model tekst napadača izvrši kao naredbu. OWASP ga svrstava na vrh liste rizika za LLM aplikacije, i nije teoretski. U lipnju 2025. istraživači Aim Securityja objavili su EchoLeak (CVE-2025-32711), propust u Microsoft 365 Copilotu: jedna pripremljena e-poruka mogla je natjerati Copilot da oda interne podatke, bez ijednog klika žrtve. Microsoft ga je zakrpao prije poznate zlouporabe - no ta vrsta napada očito radi.
Koliki je rizik zapravo?
Gartner predviđa da će se do 2028. čak 25% proboja u tvrtkama moći pripisati zlouporabi AI agenata - i od vanjskih napadača i od zlonamjernih insajdera. Prognoza iz travnja 2026. dodaje: do 2028. četvrtina generativnih AI aplikacija imat će pet ili više manjih sigurnosnih incidenata godišnje (9% u 2025.), a do 2029. njih 15% barem jedan veći. To nije razlog za izbjegavanje AI agenata - nego razlog da ih uvodite kao svaki sustav koji dira novac i podatke: promišljeno.
Tri sastojka koja ne smiju zajedno
Agent postaje opasan kad se u istom procesu spoje tri stvari: pristup osjetljivim podacima, izloženost nepouzdanom sadržaju i mogućnost komunikacije prema van. Sigurnosni istraživač Simon Willison to zove “smrtonosnim trojcem”, a Gartner poručuje da se ta kombinacija tretira kao zabranjena zona - jer zajedno čine gotov kanal za izvlačenje podataka. Praktično pravilo: agent smije imati bilo koja dva od ta tri. Treba li slučaj sva tri, redizajnirajte ga - razdvojite proces, dodajte korak odobrenja ili uklonite vanjski kanal.
Kako zaštititi AI agenta
- Načelo najmanjih ovlasti. Agent dobiva vlastiti, usko ograničen identitet - ne naslijeđenu ulogu zaposlenika.
- Sav vanjski sadržaj tretirajte kao nepouzdan - svaku e-poruku, dokument i stranicu koju čita.
- Ljudsko odobrenje za nepovratne radnje: plaćanja, brisanja, slanje podataka van.
- Bilježite svaki poziv alata kako biste mogli provjeriti što je agent učinio i zašto.
- Ograničite izlaz - agent koji ne može doseći proizvoljne adrese ne može na njih ni procuriti podatke.
- Testirajte napadima prije lansiranja i nadzirite u produkciji, osobito agente spojene preko MCP-a s mnogo alata.
To je standardna sigurnosna disciplina primijenjena na novu komponentu - a obveznicima NIS2 incidenti agenata prijavljuju se kao i svaki drugi.
Često postavljana pitanja
Što je prompt injection? Napad koji zlonamjerne upute skriva u sadržaju koji AI čita i tako ga navede da sluša napadača umjesto korisnika. OWASP ga rangira kao najveći rizik za LLM aplikacije.
Može li se prompt injection potpuno spriječiti? Ne - pouzdan filtar još ne postoji. Zato se obrana temelji na ograničavanju štete: dozvole, odobrenja i kontrola izlaza podataka.
Jesu li AI agenti sigurni za poslovnu upotrebu? Jesu, uz ispravno ograničene ovlasti. Rizik nastaje kad se osjetljivi podaci, nepouzdan sadržaj i vanjska komunikacija spoje u jedan nenadzirani proces.
Što je “smrtonosni trojac”? Pristup privatnim podacima, izloženost nepouzdanom sadržaju i mogućnost komunikacije prema van. Zajedno omogućuju izvlačenje podataka kroz agenta.
Vrijede li GDPR i NIS2 za AI agente? Vrijede. Podaci koje agent oda povreda su osobnih podataka po GDPR-u, a obveznicima NIS2 incidenti agenata ulaze u redovne obveze prijave.
Povezani članci
- Što je agentic AI? Agentic vs generativna AI
- MCP: spajanje AI agenata s poslovnim sustavima
- Kibernetička sigurnost za male i srednje tvrtke
Uvodite AI agente?
Gradimo i revidiramo AI agente s najmanjim ovlastima, koracima odobrenja i potpunim tragom revizije - da automatizacija ne postane Vaš sljedeći proboj.
Javite nam se na [email protected] ili putem obrasca na našoj stranici.