Google je globalno otvorio pristup alatu SynthID Detector, web usluzi koja korisnicima omogućuje provjeru fotografija, videozapisa i audiozapisa te utvrđivanje sadrže li digitalni vodeni žig povezan s umjetnom inteligencijom. Alat je ranije bio dostupan ograničenom broju novinara, istraživača i stručnjaka za medije, a sada ga Google širi na sve korisnike. Za korištenje je potrebno prijaviti se Google računom, dok je sučelje trenutačno dostupno na engleskom jeziku.

Ključna stvar pritom je da SynthID Detector nije univerzalni AI detektor. Ne pokušava zaključiti je li određena fotografija ili snimka generirana umjetnom inteligencijom analizirajući njezin izgled ili tražeći vizualne anomalije. Umjesto toga, provjerava postoji li u datoteci nevidljivi digitalni vodeni žig koji je ugrađen pomoću tehnologije SynthID.

Kako funkcionira SynthID?

SynthID je Googleova tehnologija digitalnog označavanja sadržaja koju je Google DeepMind predstavio 2023. godine. Vodeni žig ugrađuje se izravno u sadržaj tijekom njegova generiranja ili obrade. Za razliku od klasičnog logotipa ili vidljive oznake „AI generated“, SynthID je dizajniran tako da ljudskom oku ili uhu nije primjetan te da što manje utječe na kvalitetu sadržaja. Sustav je tijekom razvoja proširen sa slika na video i audio sadržaj. Google ga danas koristi u nizu svojih AI proizvoda, uključujući modele i alate kao što su Gemini, Imagen, Veo i Lyria, kao i druge proizvode koji generiraju multimedijski sadržaj.Prednost digitalnog vodenog žiga jest u tome što može preživjeti dio uobičajenih postupaka obrade. Google navodi da se signal može zadržati i nakon operacija poput kompresije, izrezivanja, primjene filtara ili promjene broja sličica u sekundi. To znači da detektor ne mora analizirati samo originalnu datoteku kako bi pokušao pronaći trag SynthID-a.

Podržani su fotografije, video i audio

SynthID Detector zamišljen je kao multimedijski alat. Korisnik može prenijeti različite vrste datoteka, uključujući formate poput JPG-a, PNG-a, WEBP-a, HEIC-a, TIFF-a i GIF-a za slike. Kod videozapisa podržani su, među ostalim, MP4, MOV i WEBM, dok se kod audiozapisa mogu koristiti WAV, MP3, OGG, FLAC, AAC i M4A formati. Nakon analize alat pokušava utvrditi postoji li SynthID signal. Kada ga pronađe, može pokazati i koji dijelovi sadržaja najvjerojatnije sadrže vodeni žig. Kod slike to može biti određeno područje, dok se kod zvuka ili videa detekcija može odnositi na određeni vremenski segment. Google navodi da je SynthID dosad korišten za označavanje goleme količine AI sadržaja – više od 180 milijardi slika i videozapisa, uz količinu audiozapisa koja odgovara približno 240.000 godina zvuka.

Ovo nije klasični AI detektor

Najvažnija razlika u odnosu na brojne postojeće AI detektore jest način rada. Klasični detektor može pokušavati procijeniti je li fotografija generirana umjetnom inteligencijom na temelju statističkih ili vizualnih karakteristika – primjerice neprirodnih detalja, osvjetljenja, tekstura ili drugih obrazaca. SynthID radi drugačije: traži prethodno ugrađeni identifikacijski signal. Zbog toga je rezultat potencijalno pouzdaniji kada je sadržaj nastao pomoću sustava koji podržava SynthID. No istodobno postoji i ključno ograničenje. Ako SynthID Detector ne pronađe vodeni žig, to ne znači da je sadržaj nužno napravio čovjek. Fotografija može biti generirana drugim AI modelom koji ne koristi SynthID, a detektor tada jednostavno nema odgovarajući signal koji bi mogao pronaći. Drugim riječima, rezultat „SynthID nije pronađen“ ne treba tumačiti kao potvrdu autentičnosti sadržaja.

SynthID izlazi izvan Googleova ekosustava

Google tehnologiju pokušava pozicionirati kao širi standard za označavanje AI sadržaja, a ne samo kao značajku vlastitih proizvoda. Prema Googleu, podršku za SynthID već imaju i pojedini sustavi drugih kompanija, među kojima su OpenAI, NVIDIA i Kakao, dok se očekuje i podrška Applea. Google istodobno ugrađuje mogućnosti provjere AI sadržaja u vlastite proizvode. SynthID provjera dostupna je unutar Geminija, a tehnologija se integrira i u Chrome i Googleove proizvode povezane s pretraživanjem. Prema Googleovim podacima, sustavi za provjeru trenutačno obrađuju više od milijun zahtjeva dnevno.

SynthID i C2PA nisu ista tehnologija

Google uz SynthID podržava i Content Credentials, odnosno standard koji razvija C2PA (Coalition for Content Provenance and Authenticity). Iako oba pristupa pokušavaju riješiti isti širi problem – utvrđivanje podrijetla digitalnog sadržaja – tehnički funkcioniraju različito. SynthID ugrađuje nevidljivi signal izravno u sadržaj. Taj signal može ostati prisutan i nakon određenih oblika obrade. C2PA Content Credentials funkcionira više kao digitalni zapis o podrijetlu sadržaja. Metapodaci mogu sadržavati informacije o tome kako je datoteka nastala, kojim je alatom izrađena ili obrađena te koje su promjene napravljene tijekom njezina životnog ciklusa. C2PA stoga može pružiti znatno više informacija o „lancu porijekla“ datoteke, dok je SynthID prvenstveno mehanizam za prepoznavanje sadržaja koji nosi odgovarajući vodeni žig.

Ni jedan sustav nije savršen

Unatoč velikom tehnološkom napretku, SynthID Detector ne može riješiti problem deepfakeova i AI sadržaja sam po sebi. Njegova najveća prednost ujedno je i njegovo najveće ograničenje: može pouzdano tražiti samo ono za što postoji odgovarajući SynthID signal. Ako netko generira sliku pomoću modela koji ne koristi SynthID, alat nema dovoljno informacija da bi samo na temelju negativnog rezultata zaključio da je riječ o ljudski izrađenom sadržaju. Isto vrijedi i za sadržaj koji je nastao prije nego što je odgovarajuća tehnologija označavanja bila dostupna. Zbog toga SynthID treba promatrati kao alat za provjeru podrijetla sadržaja, a ne kao univerzalni stroj za otkrivanje AI-ja.

Ipak, kako sve veći broj AI platformi počinje koristiti digitalne vodene žigove i standarde poput SynthID-a i C2PA-a, korisnici dobivaju sve više tehničkih mogućnosti za provjeru autentičnosti multimedije. U trenutku kada je AI-generirane fotografije, videozapise i zvuk sve teže razlikovati od stvarnog sadržaja, takvi sustavi postaju jedan od ključnih slojeva digitalne provjere – uz klasičnu provjeru izvora, konteksta i vjerodostojnosti samog sadržaja.