Koje AI platforme označavaju svoj sadržaj 'vodenim žigom'? I kako to rade - odgovaraju same
Kako bismo doznali označavaju li AI modeli sadržaj, nakon što ga generiraju, tako da svi znaju da je to - proizvod AI-ja, pitali smo promptom izravno najpoznatije i najpopularnije AI platforme. Može li se vjerovati njihovim odgovorima? Pa, pitali smo i to, opet AI. Kakva roba, takvo i "novinarsko" istraživanje
Nedavna objava Anthropica o tome kako će dodavati vodeni žig u svoje "radove", potaknula nas je na istraživanje kako to rješavaju ostali modeli. Ovoj temi smo pristupili na način da smo se potpuno oslonili na AI - zadani prompt napisala je platforma Qwen. Svakom je AI modelu kroz prompt dodijeljena uloga korporativnog inženjera koji vlastitu tehnologiju objašnjava javnosti. Evo kako su odgovorile pojedine AI platforme. Odgovore nismo dorađivali i uređivali, ali činjenično smo ih provjerili putem platforme KIMI koja je napisala komentar o svakom od dobivenih odgovora.

Anthropic – Claude
Claude od 11. kolovoza 2026. označava ono što proizvede, jer nas na to obvezuje Kodeks ponašanja uz članak 50. stavak 2. Akta o umjetnoj inteligenciji. Radimo to na dvije razine, jer tekst i datoteke traže različite pristupe.
Tekst dobiva nevidljivi statistički vodeni žig koji ugrađujemo dok ga model generira. Ključno je gdje leži: kodiran je u tome koje tokene – najmanje jedinice teksta – model bira, a ne u skrivenim znakovima Unicodea, kako neki misle. Zato signal živi u samim riječima; preživljava kopiranje i lijepljenje i može ostati kroz laganije uređivanje, ali budimo iskreni – parafraziranje ili prepisivanje ga poništavaju. Kod datoteka idemo drukčije: potpisujemo metapodatke o podrijetlu po standardu C2PA za formate koje podržavamo (.svg, .png, .jpg), i iz njih se vidi je li Claude obradio datoteku te je li metapodatak netko naknadno dirao.
Oko dosega želim biti precizan. Žig primjenjujemo na modele koje smo lansirali 2. kolovoza 2026. ili poslije, a potporu ćemo proširiti i na starije; radi na razini modela, pa je prisutan na svakom našem sučelju i kod svakog partnera u oblaku (cloud). I jedno upozorenje koje ne bih preskočio: ako naš detektor prepozna žig, to znači da je Claude sadržaj obradio – ne nužno i napisao, jer nam ljudi stalno predaju vlastiti tekst na uređivanje ili prijevod. Naposljetku, alate za detekciju još nismo objavili, pa treće strane zasad ne mogu neovisno provjeriti naše oznake. Na tome radimo.
KIMI komentar: Članak je tehnički uglavnom točan, ali sadrži jednu značajnu zavaravajuću tvrdnju na kraju. Autori pišu da „alate za detekciju još nismo objavili, pa treće strane zasad ne mogu neovisno provjeriti naše oznake". To je istina samo za tekstualni vodeni žig – C2PA metapodatke na datotekama (.svg, .png, .jpg) moguće je već danas provjeravati standardnim, besplatnim alatima (npr. Content Credentials Verify), bez obzira na to što Anthropic nije objavio vlastiti detektor. Članak nepravilno poistovjećuje nedostatak tekstualnog detektora s nemogućnošću neovisne provjere svih oznaka, što čitatelju daje krivu sliku o transparentnosti.

Google DeepMind – SynthID
Kao predstavnik Google DeepMinda, mogu reći da smo razvili jedan od najcjelovitijih sustava za označavanje i identifikaciju AI-generiranog sadržaja na tržištu. Svjesni smo da je s razvojem generativne umjetne inteligencije ključno osigurati transparentnost, autentičnost i povjerenje u medijskom prostoru. Upravo zato problemu nismo pristupili parcijalno, nego smo stvorili tehnologiju SynthID koja pokriva sve ključne modalitete – slike, video, zvuk i tekst.
Evo kako smo taj izazov riješili i zašto je naš pristup poseban:
1. Slike, video i zvuk: vodeni žig ugrađen u same piksele i valoveZa vizualne i zvučne medije razvili smo vlasničke modele za ugrađivanje koji neovisno i neprimjetno mijenjaju same podatke. Kod slika i videa vodeni žig ugrađujemo izravno u piksele i videookvire. Kod zvuka izmjene unosimo u zvučne spektrograme, tako da su ljudskom uhu potpuno nečujne.
Ključna je prednost SynthID-a u ovim modalitetima njegova robusnost. Tradicionalni vodeni žigovi ili metapodaci lako se brišu izrezivanjem ili pretvorbom formata; SynthID smo projektirali tako da preživi uobičajene manipulacije – kompresiju, izrezivanje (cropping), promjenu rezolucije, filtriranje i ponovno kodiranje.
2. Tekst: SynthID Text i otvoreni kod za zajednicu
Označavanje generiranog teksta dugo je bilo jedan od najtežih izazova u industriji jer tekst nema piksele ni frekvencije u koje bi se vodeni žig sakrio. Riješili smo to na razini uzorkovanja tokena.
Naš obrađivač logita (logits processor) presreće proces nakon Top-K i Top-P uzorkovanja. Koristeći pseudoslučajnu funkciju nazvanu turnirsko uzorkovanje (tournament sampling), unosimo blagu, kontroliranu pristranost u izbor idućih tokena. Time u tekstu stvaramo statistički obrazac koji je nevidljiv čitatelju i ne narušava kvalitetu, kreativnost ni povezanost generiranog teksta.
Za razliku od naših modela za slike i zvuk, koji ostaju vlasnički, SynthID Text odlučili smo podijeliti sa svijetom. U listopadu 2024. objavili smo ga kao otvoreni kod u sklopu našeg Responsible GenAI Toolkita (dostupan od verzije Hugging Face Transformers 4.46+ pod licencom Apache 2.0), a matematički i znanstveni algoritam recenziran je i objavljen u časopisu Nature (svezak 634, listopad 2024.).
3. Detekcija i pouzdanost
Svi naši sustavi detekcije rade na vjerojatnosnom načelu. Kada analiziramo sadržaj, sustav ne daje binarni odgovor (da/ne), nego vraća jedno od tri stanja: označeno (marked) – visoka vjerojatnost da je sadržaj nastao našim modelima; neizvjesno (uncertain) – sadržaj ima netipične značajke ili je previše izmijenjen za konačan sud; i neoznačeno (unmarked) – vodeni žig nije otkriven. Takav pristup smanjuje rizik od lažno pozitivnih rezultata i korisniku daje jasan uvid u razinu pouzdanosti analize.
Naša vizija nikada nije bila izolirani ekosustav. Vjerujemo da transparentnost umjetne inteligencije zahtijeva širu suradnju. SynthID je danas postao de facto međuproizvođačka konvencija – tehnologiju i načela koja primjenjujemo prihvatili su i integrirali vodeći akteri u industriji, uključujući Google, OpenAI, Nvidiju i druge. U kombinaciji s otvorenim standardima poput C2PA Content Credentials osiguravamo da digitalni sadržaj budućnosti nosi jasan i provjerljiv trag svojega podrijetla.
KIMI komentar: Najveća je netočnost preuveličavanje raširenosti. Tvrdnja da je SynthID „de facto međuproizvođačka konvencija" koju su prihvatili „Google, OpenAI, Nvidia i drugi" pretjerana je i zavaravajuća. OpenAI je u svibnju 2026. integrirao SynthID isključivo za slike (i naknadno za zvuk), no to ga ne čini univerzalnom industrijskom normom – većina generativnih AI alata na tržištu i dalje ga ne koristi. Također, članak nedovoljno jasno razlikuje što je otvorenog koda: samo je SynthID Text (algoritam za tekst) otvorenog koda od listopada 2024. Vodeni žigovi za sliku, video i zvuk ostaju strogo vlasnički i dostupni samo unutar Googleova ekosustava te odabranih partnera.
OpenAI – SynthID i C2PA za slike i zvuk, bez vodenog žiga na tekstu
Medije označavamo kombinacijom otvorenog standarda i tehnologije našeg partnera Googlea. Kod teksta smo, kao što ćemo objasniti, donijeli drukčiju odluku – i o njoj želimo biti otvoreni.
1. Slike i zvuk
Slike iz našeg modela DALL·E 3 nose metapodatke C2PA (Content Credentials, vjerodajnice sadržaja) od veljače 2024. Od 19. svibnja 2026. svaka slika iz ChatGPT-a, Codexa i našeg sučelja (API) nosi i vodeni žig SynthID, na temelju partnerstva s Googleom. Tako dobivamo dva sloja koji se nadopunjuju: sloj metapodataka i sloj upisan u same piksele, otporan na snimku zaslona. Zvuku smo SynthID vodeni žig dodali 31. srpnja 2026., zajedno sa sučeljem (API) za provjeru podrijetla.
2. Tekst: zašto ga zasad ne označavamo
Za tekst u našim javnim proizvodima ne primjenjujemo vodeni žig, i o tome želimo govoriti izravno. Sustav za vodeni žig teksta izgradili smo i on je u internim ispitivanjima vrlo učinkovit, no odlučili smo ga ne objaviti. Razlozi su dva: pitanje robusnosti – takav se žig razmjerno lako zaobilazi – i otpor korisnika, koji su nam u istraživanju jasno dali do znanja kako bi ga dio njih doživio kao problem. Zasebno, naš raniji klasifikator AI Text Classifier povukli smo u srpnju 2023. jer mu točnost nije bila na razini koju bismo mogli stajati iza. Radije nemamo alat nego da nudimo onaj u koji nemamo povjerenja.
3. Ispravak jedne raširene tvrdnje
Želimo razjasniti nesporazum koji kruži o našim modelima. Nevidljivi znakovi poput uskog neprelomivog razmaka (U+202F) i sličnih, uočeni u novijem izlazu GPT-a, nisu vodeni žig – niti smo ih tako zamislili. Riječ je o artefaktima učenja podržanog pojačanjem (reinforcement learning), a i forenzička analiza slaže se da najvjerojatnije proizlaze iz kvalitetnih višejezičnih i tipografskih podataka na kojima model treniramo. Ne treba ih tumačiti kao namjeran signal podrijetla; naši ih detektori AI teksta i ne čitaju.
KIMI komentar: Dijelovi su neprovjereni ili se službeni status pripisuje onome što je zapravo spekulacija. Objašnjenje za U+202F (uski neprelomivi razmak) – da su to „artefakti učenja podržanog pojačanjem" iz višejezičnih podataka – u članku se prezentira kao izravna izjava tvrtke OpenAI, no zapravo se radi o zaključcima iz korisničke zajednice i forenzičkih promatranja, a ne o službenom dokumentu tvrtke. Također, točan datum „31. srpnja 2026." za uvođenje SynthID-a na zvuk nije neovisno potvrđen u dostupnim izvorima te može biti spekulacija ili interna informacija koja nije javno dokumentirana.

Microsoft – Copilot i Azure OpenAI
Naš je pristup drukčiji od pristupa tvrtki koje označavanje ugrađuju na razini jednog modela: mi ga ugrađujemo u poslovni stog (stack, skup poslovnih alata i usluga) i, što nam je najvažnije, kontrolu nad njim dajemo organizaciji. Za nas transparentnost AI sadržaja nije samo tehničko pitanje, nego pitanje upravljanja (governance) – a u poslovnom okruženju to znači da administrator, a ne mi umjesto njega, odlučuje što će i kako biti označeno.
1. Azure OpenAI: podrijetlo na razini platforme
Slikama koje kroz Azure OpenAI nastaju iz modela DALL·E pridružujemo metapodatke C2PA od kraja 2023. Od rujna 2024. dodajemo im i nevidljivi vodeni žig upisan u same piksele, zasad u javnom pretpregledu (public preview). Tako organizacijama koje grade rješenja na našoj platformi omogućujemo da AI podrijetlo prati sadržaj i onda kada napusti našu infrastrukturu.
2. Microsoft 365 Copilot: oznaka pod nadzorom administratora
U sklopu paketa Microsoft 365 Copilot organizacije od početka 2026. mogu uključiti pravilo koje dodaje čujni vodeni žig na AI-generiran zvuk i vidljivi vodeni žig na AI-generiran video; metapodatke o AI podrijetlu ugrađujemo bez obzira na tu postavku. Ovdje je ključna filozofija kontrole: pravilo je u rukama administratora i prema zadanome je isključeno, jer smatramo da je odluka o njegovoj primjeni na organizaciji. Iz istog razloga vodene žigove na slikama prepuštamo kontroli samog korisnika. Dužni smo napomenuti i jedno ograničenje dostupnosti – pravilo zasad nije dostupno tenantima državnih tijela u SAD-u (tenant je zasebna, izolirana instanca organizacije unutar oblaka).
3. Tekst: budimo precizni
Ovdje želimo izbjeći nesporazum. Univerzalni vodeni žig na tekstu koji Copilot generira nismo potvrdili – takva oznaka nije dio našeg javno dokumentiranog skupa mogućnosti. Ono što ugrađujemo odnosi se na medije i na metapodatke o podrijetlu, a ne na statistički žig u samom tekstu, kakav primjenjuju neki drugi.
KIMI komentar: Ovdje postoje dvije ozbiljnije netočnosti. Prvo, tvrdnja da za video i zvuk „metapodatke o AI podrijetlu ugrađujemo bez obzira na tu postavku" preuranjena je ili netočna. Prema službenoj Microsoftovoj dokumentaciji i pravnim analizama, C2PA metapodaci za video i zvuk najavljeni su kao buduća mogućnost, a trenutačno su dostupni samo za slike. Drugo, tvrdnja da Azure OpenAI ima C2PA metapodatke „od kraja 2023." upitna je – OpenAI je C2PA uveo za DALL·E 3 tek u veljači 2024., a Microsoftov vlastiti vremenski slijed za Azure OpenAI nije jasno dokumentiran za kraj 2023. Članak na taj način pripisuje Microsoftu zrelost sustava koja još nije u potpunosti operativna.