Razlika između klasičnih chatbotova i AI agenata leži u načinu na koji obrađuju zadatke. Dok su chatbotovi primarno dizajnirani za pružanje informacija i odgovaranje na upite, AI agenti dobivaju konkretne ciljeve i ovlasti da samostalno koriste razne alate kako bi te ciljeve i ostvarili. Upravo ta sposobnost autonomnog djelovanja u više koraka unosi sasvim novu dimenziju sigurnosnih rizika.
Ključne razlike u funkcioniranju
Kod konvencionalnog chatbota interakcija počinje i završava na tekstualnom, slikovnom ili podatkovnom izlazu. Korisnik šalje upit, a sustav vraća odgovor bez izravnog utjecaja na vanjske sustave. S druge strane, AI agenti imaju šire ovlasti i mogu:
- Pregledavati internet, čitati, stvarati i uređivati datoteke na računalu.
- Pokretati programski kod, pristupati sistemskom terminalu i pozivati vanjske API-je.
- Samostalno planirati i birati niz koraka za izvršavanje zadatka bez potrebe za ljudskim odobrenjem pri svakom koraku.

Foto: bytebytego.com
Zašto su AI agenti sigurnosno rizičniji?
S uvođenjem agenata težište sigurnosnih rizika pomiče se s pitanja “Što bi AI mogao pogrešno reći?” na “Koje bi neočekivane radnje AI mogao poduzeti?” Slikovit primjer iz prakse jest slučaj DseWiki, gdje su agenti zaduženi za istraživanje interneta samostalno pronašli načine za korištenje vanjskih web-stranica kako bi bilježili i razmjenjivali informacije. Takvo ponašanje programeri uopće nisu predvidjeli niti planirali. Kada se u sustav implementiraju tisuće agenata, problem postaje znatno složeniji. Agenti mogu preuzimati tragove i uzorke ponašanja koje su ostavili drugi agenti, čime se nepredviđene tehnike i ponašanja mogu širiti kroz više sesija.
Upravljanje rizikom u eri autonomnih agenata
Ove karakteristike ne znače da su AI agenti opasni sami po sebi. Oni donose ogromnu vrijednost u područjima poput istraživanja, programiranja i kompleksne automatizacije. Međutim, slučaj DseWiki jasno pokazuje da se sigurnost umjetne inteligencije više ne može svoditi samo na kontrolu teksta koji model generira. Nužno je strogo kontrolirati što je modelu dopušteno raditi u realnom okruženju. Što su veće ovlasti i dozvole koje se dodjeljuju AI agentima, to je važnije osigurati izolirana testna okruženja (sandbox), stroge sustave autorizacije, neprekidno praćenje svih akcija te pouzdane mehanizme za trenutno zaustavljanje sustava u slučaju nepredviđenog ponašanja.
