SynthID-Text radi u Geminiju i Claudeu. API za detekciju i dalje ne postoji.

Dvojica od tri najveća isporučioca jezičkih modela sada vodenim žigom obeležavaju tekst koji generišu. Google to radi u Geminiju od 2024. Anthropic je žig uključio za Claude 14. avgusta 2026. Obojica koriste isti metod, SynthID-Text, koji je Google DeepMind objavio u časopisu Nature.
Ako želite da proverite da li dati pasus nosi neki od tih žigova, ne možete. Ni preko API-ja, ni preko portala, ni otvorenim alatom. Oznaka je tu, načelno je mašinski čitljiva, a jedine mašine koje umeju da je pročitaju pripadaju onim dvema kompanijama koje su je i stavile.
Taj procep teži je nego pre godinu dana, jer Akt o veštačkoj inteligenciji sada ima rok za označavanje sa konkretnim datumom, a poprilično ljudi je počelo da kupuje alate koji tobože zatvaraju procep, a ne zatvaraju ga.
Šta SynthID-Text zapravo radi
Preciznost se ovde isplati, jer je većina onoga što se piše o vodenim žigovima u tekstu VI pogrešna na potpuno isti način.
SynthID-Text ne dodaje tekstu ništa. Nema znakova nulte širine, nema neobičnog Unicodea, nema nevidljivih markera, nema izdajničke interpunkcije, nema dodatnih tokena. Anthropic to kaže doslovno i važi za metod uopšte. Ako ste ikada naišli na savet da uklonite nevidljive znakove kako biste zaobišli vodeni žig VI, taj savet cilja na nešto što ovde ne postoji.
Ono što metod radi jeste da menja kako model bira reči.
Kada jezički model generiše tekst, formira raspodelu verovatnoće nad sledećim tokenom i iz nje uzorkuje. SynthID-Text se meša tačno na tom koraku. Klizni prozor poslednjih tokena, obično četiri, heširan zajedno sa tajnim ključem vodenog žiga daje seme. To seme pokreće skup pseudoslučajnih funkcija bodovanja, funkcija g. Algoritam izvlači kandidate tokene i propušta ih kroz nekoliko turnirskih slojeva: svaki sloj funkcijom g boduje kandidate koji se takmiče, a pobednik ide dalje. Token koji pobedi na turniru jeste onaj koji izlazi.
Rezultat je da na dovoljno dugom pasusu ispisani tokeni koreliraju sa vrednostima g na način koji ljudski izbor reči ne bi proizveo. Detekcija je tada statistički test: ponovo izračunajte vrednosti g preko teksta i pitajte da li je prosek viši nego što bi slučajnost dopustila. Objavljeni detektori dolaze u tri varijante: običan prosek, ponderisani prosek i bajesovski detektor obučen na obeleženim i neobeleženim uzorcima, najjači od tri.
Iz ovog dizajna slede dva svojstva koja objašnjavaju gotovo sve ostalo.
Prvo, detekcija ne traži model. Ne morate da pokrećete Gemini da biste proverili tekst iz Geminija. Upravo to čini šemu dovoljno jeftinom za primenu i predstavlja stvarni napredak u odnosu na naknadne klasifikatore.
Drugo, detekcija traži ključ. Funkcije g njime se zasejavaju. Bez ključa vodenog žiga vrednosti g koje izračunate nemaju veze sa onima korišćenim pri generisanju, a test vraća šum. Ovo nije implementacioni propust koji će neko jednom zatvoriti. To je bezbednosno svojstvo koje sprečava bilo koga da falsifikuje Googleov žig na tekstu koji Google nikada nije napisao.
Ceo problem detekcije sedi u tom drugom svojstvu.
Ko danas obeležava tekst
Slika u avgustu 2026, ograničena na ono što isporučioci sami potvrđuju:
Google Gemini. Obeležen od rada u časopisu Nature koji je opisao prvu primenu velikog obima, za Gemini i Gemini Advanced. Googleovi zaposleni potvrdili su na zvaničnom forumu za programere da je vodenim žigom obeležen i tekst generisan preko Gemini API-ja, Google AI Studija i Antigravityja. Taj odgovor je stigao posle prvog, netačnog odgovora u suprotnom smeru, što je pošteno merilo koliko je ovo tanko dokumentovano.
Anthropic Claude. Aktivno globalno od 14. avgusta 2026. na Claude modelima objavljenim 2. avgusta 2026. ili kasnije, stariji modeli slede. Anthropic to opisuje kao verziju pristupa SynthID-Text i ideju izvodi iz predloga Skota Aronsona iz 2022. Anthropic uz to generisanim slikovnim datotekama prilaže potpisane C2PA potvrde, što je poseban mehanizam.
OpenAI. Bez tekstualnog vodenog žiga. OpenAI je napravio jedan, prema pisanju Wall Street Journala iz 2024. veoma precizan, i ostavio ga u fioci. Navedene zamerke: slabo je podnosio prevod i temeljno prepisivanje, a mogao bi nesrazmerno da označava one kojima engleski nije maternji jezik. OpenAI, međutim, generisanim slikama prilaže C2PA Content Credentials.
Svi ostali. Modeli sa otvorenim težinama ne nose nikakvu oznaku, osim ako je ne doda onaj ko ih pokreće, a ništa ga ne sprečava da je i ukloni. To je strukturna rupa koju sam rad u časopisu Nature imenuje: obeležavanje radi samo tamo gde isporučioci sarađuju, a otvoreni modeli se ne mogu naterati na saradnju.
To što se obe primene poklapaju sa 2. avgustom 2026. nije slučajnost. To je datum kada je član 50 Akta o veštačkoj inteligenciji počeo da se primenjuje.
Alati koji postoje i čemu koji služi
Ovaj deo vredi uraditi tačno, jer su rezultati pretrage o ovoj temi teško zagađeni.
google-deepmind/synthid-text na GitHubu. Referentna implementacija iz rada u časopisu Nature, licenca Apache 2.0. Obeležava i detektuje, i sadrži kod za obuku bajesovskog detektora. Podržava Gemmu i GPT-2 preko mixin klasa. README izričito kaže da je ovo za ponovljivost istraživanja, da mixini nisu projektovani za produkciju i da heš funkcija ne daje nikakve kriptografske bezbednosne garancije. Korisno, pošteno, i nije detektor za tuđi tekst.
Hugging Face Transformers. Produkcijski put na koji Google upućuje. SynthIDTextWatermarkingConfig i SynthIDTextWatermarkLogitsProcessor omogućavaju da generišete obeležen tekst iz modela koji kontrolišete, prosleđivanjem liste ključeva i dužine n-grama. Ko ima ključeve, taj može da detektuje. Ovo je jedini put kojim običan inženjerski tim danas dobija obeležavanje teksta koje radi s kraja na kraj, a pokriva samo tekst koji je generisao vaš sopstveni sistem.
MarkLLM. Akademski komplet alata sa THU-BPM koji iza jednog interfejsa implementira mnogo algoritama vodenog žiga, među njima KGW, Unigram, EXP i SynthID-Text sa detektorima proseka, ponderisanog proseka i bajesovskim. Ako procenjujete šeme umesto da jednu primenite, počinjete ovde.
Portal SynthID Detector. Googleov alat za otpremanje i proveru, otvoren za rane testere na konferenciji I/O u maju 2026. preko liste čekanja za novinare, istraživače i ljude iz medija. Googleova sopstvena dokumentacija pomoći o verifikaciji navodi slike, video i zvuk. Teksta nema na toj listi, a nit na forumu za programere o obeležavanju preko API-ja jasno kaže da ga portal ne prima.
Googleov Content Detection API. Tokom 2026. u pregledu na platformi Gemini Enterprise za poimence navedene partnere, među kojima su Shutterstock, Snap, Canva i Fox Sports. Samo slike, JPEG, PNG i WebP. Bez teksta, bez datuma opšte dostupnosti, bez objavljenih cena.
Anthropicov API za detekciju. Najavljen kao nadolazeći, bez vremenskog okvira i bez detalja implementacije. Kada stigne, verovatno će odgovarati za Claude tekst i ni za šta drugo.
C2PA Content Credentials. Uopšte nije vodeni žig i pre je dopuna nego takmac. Reč je o kriptografski potpisanim metapodacima o poreklu: ko je ovo napravio, kojim alatom, kada i da li je bio uključen sistem VI, upisano u polje digitalSourceType. Verzija 2.3 dodala je manifeste za obične tekstualne dokumente, što je novo i važno. Slabost je ogledalo slabosti vodenog žiga: metapodaci nestaju pri kopiranju i lepljenju, a tekst putuje upravo tako.
A onda je tu ono što nije alat.
Veliki broj sajtova rangira se na „SynthID detection API" i opisuje proizvod koji se navodno uključuje u Google Cloud konzoli, sa cenom po zahtevu i kašnjenjem teksta ispod sekunde. Takav proizvod se nigde ne pojavljuje u dokumentaciji Google Clouda. Bar jedan od tih sajtova je sadržajni marketing za uslugu uklanjanja vodenih žigova. Odvojeno: sajtovi koji nude proveru teksta na SynthID pokreću statističke detektore VI, koji vodeni žig ne čitaju i ne mogu, jer nemaju ključ. Oni bodovima ocenjuju pisanje po predvidivosti i ritmu. To je druga stvar u istoj reči.
Koliko dobro radi
Pošten odgovor je da radi dobro na dugom, neizmenjenom tekstu visoke entropije, a izvan tih uslova brzo slabi. Brojke su javne i nisu laskave.
Dužina. Detekcija je statistički test, pa se dokazi gomilaju sa tokenima. Teorijska analiza SynthID-Texta objavljena 2026. postavlja detekciju na oko 0,3 stope tačno pozitivnih pri 1 odsto lažno pozitivnih na tekstovima od 50 tokena, a sopstvene eksperimente vodi na sekvencama od 100 do 400 tokena. Objava na društvenoj mreži, opis proizvoda ili odgovor podrške nisu dovoljno teksta.
Entropija. Vodeni žig živi od slobode modela da bira. Tamo gde je tačan odgovor samo jedan, nema mesta da se bilo šta kodira. Anthropic to kaže otvoreno: oznaka je ređa u činjeničnim pasusima i u kodu, gde sintaksa i računanje moraju biti tačni. Zamolite model da vam ispravi gramatiku i vodeni žig može da stanuje samo u onoj šačici ispravki, što može biti premalo da se registruje.
Parafraziranje. To je slaba tačka. Procena robusnosti pokazala je pad stope tačno pozitivnih kod SynthID-a sa 0,998 na čistom tekstu na 0,498 pri umerenom parafraziranju. SRI Lab sa ETH u Cirihu izveštava o preko 90 odsto uspeha u uklanjanju običnim parafraziranjem, blizu 100 odsto uz pomoć krađe vodenog žiga, i primećuje da turnirsko uzorkovanje, zamišljeno kao bezbednosna mera, čini pojačavanje tokena osetljivijim na prepisivanje, a time i manje otpornim od jednostavnijih šema. Procena iz 2026. u odnosu na forenzičke standarde izmerila je 98,3 odsto uklanjanja pri parafraziranju koje čuva značenje, uz semantičku sličnost koja ostaje oko 0,83.
Lažno pozitivni. Ista forenzička procena izmerila je stopu lažno pozitivnih od 5,4 odsto na čistom ljudskom tekstu, sa 93,6 odsto nestabilnosti presude pri malim promenama praga detekcije, i našla standardnu rečenicu iz testa kucanja koja prelazi prag. Zaključak: nijedan od tri ispitana metoda, KGW, Unigram i SynthID-Text, ne zadovoljava više od dva od pet Daubertovih faktora za veštačenje.
Falsifikovanje. Ovde se SynthID-Text drži bolje od alternativa. Rad SRI Laba navodi 4 odsto uspeha u falsifikovanju sa podrazumevanim parametrima naspram 80 odsto i više kod crveno-zelenih šema, mada je uspeh porastao na 15 odsto kada su napadačevi upiti otišli sa 30.000 na 90.000. Isti rad je pokazao i da se samo prisustvo vodenog žiga može otkriti upitima po principu crne kutije, pa držanje primene u tajnosti nije opcija.
Sve zajedno: pozitivan ishod na dugom pasusu jeste smislen dokaz. Negativan ishod ne znači gotovo ništa, jer je jednako saglasan sa ljudskim pisanjem, sa modelom bez žiga, sa kratkim uzorkom ili sa parafrazom. Ko na ovome gradi radni tok, mora tu asimetriju da usvoji pre nego što nacrta interfejs.
Šta traži pravo
Tri režima sada nešto traže u ovoj oblasti i nijedan se sasvim ne poklapa sa onim što je primenjeno.
Akt o veštačkoj inteligenciji, član 50 stav 2. Isporučioci sistema VI koji generišu sintetički zvučni, slikovni, video ili tekstualni sadržaj moraju da označe izlaze u mašinski čitljivom formatu tako da se mogu detektovati kao veštački generisani. Označavanje mora biti delotvorno, interoperabilno, robusno i pouzdano u meri u kojoj je tehnički izvodljivo. Član 50 počeo je da se primenjuje 2. avgusta 2026, a zahtevi za označavanje i etiketiranje stižu 2. decembra 2026, kada ističe i prelazni period za sisteme koji su već bili na tržištu pre 2. avgusta 2026. Kodeks prakse upućuje na slojevit pristup koji kombinuje metapodatke, vodeni žig i evidentiranje. C2PA ne pominje imenom, ali osobine standarda opisuje toliko blisko da su posmatrači primetili kako je C2PA trenutno jedina primenjena tehnologija koja odgovara. Širu sliku člana 50 obradili smo u našem vodiču kroz obaveze transparentnosti Akta o VI.
Obratite pažnju na reč interoperabilno. Vodeni žig koji ume da pročita samo njegov autor čudno se uklapa u taj zahtev, a ta napetost ostaje nerazrešena.
Kina. Mere za označavanje sintetičkog sadržaja generisanog veštačkom inteligencijom stupile su na snagu 1. septembra 2025. i najkonkretnije su od sve tri. Zahtevaju i izričitu oznaku, vidljivu korisniku, i implicitnu oznaku u metapodacima datoteke. Tekst je obuhvaćen. Platforme moraju da obezbede funkcije označavanja, a korisnici koji objavljuju sadržaj generisan veštačkom inteligencijom moraju to da prijave.
Kalifornija. AI Transparency Act, SB 942 izmenjen aktom AB 853, primenjuje se od 2. avgusta 2026. na isporučioce sa preko milion mesečnih korisnika. Zahteva besplatan alat za detekciju, vidljivo obelodanjivanje i ugrađeno latentno obelodanjivanje sa imenom isporučioca, imenom i verzijom sistema, vremenskom oznakom i jedinstvenim identifikatorom. Pažljivo pročitajte opseg: obaveza latentnog obelodanjivanja odnosi se na sliku, video i zvuk. Teksta u njoj nema. Od 1. januara 2027. velike onlajn platforme moraće da prikazuju podatke o poreklu i neće smeti svesno da ih uklanjaju.
Obrazac je svuda isti. Pravo traži oznake koje se mogu detektovati, a primenjene tekstualne oznake mogu da detektuju samo njihovi autori. Ili će se detekcija otvoriti, ili će se obaveze za tekst ispunjavati metapodacima u stilu C2PA koji kopiranje i lepljenje praktično nikad ne prežive.
Šta ovo znači ako pravite softver
Većina ovoga nije projekat usklađenosti. To je šačica inženjerskih odluka koje su sada jeftine, a kasnije skupe za naknadnu ugradnju.
Ne kupujte detektor kao presudu. Ako dobavljač tvrdi da detektuje SynthID u proizvoljnom tekstu, ne može, i tražite mu ključ. Ako već pokrećete detekciju VI nad onim što korisnici šalju, tretirajte skor kao trijažu koja vodi ka čoveku, nikada kao nalaz. Dokazi protiv upotrebe sa posledicama su jaki: studija sa Stanforda pokazala je da su detektori pogrešno svrstali među generisane veštačkom inteligencijom više od polovine TOEFL eseja autora kojima engleski nije maternji jezik, a sve duži spisak univerziteta isključio je ove alate pošto su ljudski rad označavali sa sto odsto sigurnosti. Graditi politiku na tome jeste rizik od odgovornosti, a ne kontrola.
Prestanite da uklanjate metapodatke o poreklu. To je najčešća samonanesena rana. Cevovodi za obradu slika rutinski prekodiraju, menjaju veličinu i normalizuju, a većina usput odbacuje C2PA manifeste i XMP. Po članu 50 stav 2 to ste vi koji uklanjate označavanje koje pravo hoće da sačuva, a od januara 2027. u Kaliforniji je to obaveza platforme. Pregledajte cevovod, sačuvajte manifest ili ponovo potpišite posle transformacije. Sada kada C2PA 2.3 podržava obične tekstualne dokumente, ista disciplina se sprema i za tekst.
Vodite sopstvenu evidenciju porekla. To je deo koji zaista radi. Šta god vodeni žig radio, vaš sistem zna koji je model šta generisao, kada, kojim promptom i ko je pregledao. Čuvajte to kao polje u zapisu. To je dokaz za izuzetak o ljudskom pregledu iz člana 50, to je ono što pružate regulatoru ili klijentu, i ne zavisi od toga hoće li iko objaviti API.
Ko sam hostuje, ima ceo krug. Tim koji pokreće sopstveni model na Hugging Face Transformers može da obeležava pri generisanju i detektuje kasnije, jer drži ključeve. Ako pravite sadržaj u velikom obimu i kasnije morate da prepoznate sopstveni izlaz, to je danas dostupno i niko vam to ne prodaje.
Postavite dobavljačima pravo pitanje. Ne „da li obeležavate", na šta je odgovor danas obično da i ništa ne govori. Pitajte da li oznaku možete da pročitate vi ili samo oni, šta se s njom dešava pri uređivanju i prevođenju, da li se prilažu C2PA metapodaci i uz koje formate, i šta su spremni ugovorom da izjave o članu 50 stav 2 posle 2. decembra 2026.
Kuda ovo ide
Tehnologija je stvarna, a rezultat u časopisu Nature ozbiljan je inženjerski posao: vodeni žig koji košta pola procenta kašnjenja, prolazi procenu na oko 20 miliona stvarnih odgovora Geminija bez merljive promene zadovoljstva korisnika, i detektuje se bez diranja modela. To nije malo.
Primena je zasad i zatvorena. Dva isporučioca obeležavaju tekst, nijedan ne dopušta drugome da pročita oznaku, treći je jednu napravio pa je odložio, a otvoreni modeli stoje sasvim izvan sistema. Procep između onoga što pravila o označavanju traže i onoga što neko izvan tih kompanija zaista može da proveri jeste zanimljiv problem, i nije tehnički.
Klijentima savetujemo da na detekciju ne potroše ništa, a na poreklo nešto. Detekcija koju ne možete da pokrenete niti da joj verujete nije kontrola. Uredna evidencija onoga što su vaši sistemi generisali, i cevovod resursa koji prestaje da uništava već priložene metapodatke, jeste posao koji sami kontrolišete, i upravo se toga rok 2. decembra 2026. zaista tiče. Gde ovo stoji među svim ostalim do 2028, opisuje naš vodič kroz digitalnu usklađenost EU 2026.
Ugrađujemo funkcije VI u proizvode kompanija koje posluju u Evropi, što znači da su polja o poreklu, cevovodi resursa koji čuvaju potvrde i revizorski tragovi deo uobičajene isporuke, a ne posebna vežba. Ako želite pregled toga gde sadržaj generisan veštačkom inteligencijom ulazi u vaš proizvod i šta se dešava s njegovim poreklom na izlazu, pišite na office@c9group.dev.
Mi smo inženjeri, ne pravnici. Da li vas određena obaveza pogađa kao isporučioca ili kao korisnika sistema, pitanje je za vašeg pravnog savetnika. Mi se staramo da sistem odgovara tom odgovoru.