Back to Articles

SynthID-Text on käytössä Geminissä ja Claudessa. Tunnistusrajapintaa ei silti ole.

dictionary page showing the entries credible and credibility

Kaksi kolmesta suurimmasta kielimallitoimittajasta vesileimaa nykyään tuottamansa tekstin. Google on tehnyt sen Geminissä vuodesta 2024. Anthropic kytki sen päälle Claudessa 14. elokuuta 2026. Molemmat käyttävät samaa menetelmää, SynthID-Textiä, jonka Google DeepMind julkaisi Naturessa.

Jos haluat tarkistaa, kantaako jokin kappale kumpaakaan näistä leimoista, et pysty. Et rajapinnan kautta, et portaalin kautta, et avoimen lähdekoodin työkalulla. Merkki on siellä, se on periaatteessa koneluettava, ja ainoat koneet jotka osaavat lukea sen kuuluvat niille kahdelle yhtiölle jotka sen laittoivat.

Tuo aukko painaa enemmän kuin vuosi sitten, sillä tekoälyasetuksella on nyt merkintämääräaika jolla on päivämäärä, ja moni on alkanut ostaa työkaluja jotka väittävät paikkaavansa aukon eivätkä paikkaa.

Mitä SynthID-Text oikeasti tekee

Tarkkuus kannattaa tässä, koska suurin osa tekoälytekstin vesileimoista kirjoitetusta on väärässä täsmälleen samalla tavalla.

SynthID-Text ei lisää tekstiin mitään. Ei nollanlevyisiä merkkejä, ei outoa Unicodea, ei näkymättömiä merkitsimiä, ei paljastavaa välimerkitystä, ei ylimääräisiä tokeneita. Anthropic sanoo tämän suoraan, ja se pätee menetelmään yleisesti. Jos olet joskus nähnyt neuvon poistaa näkymättömät merkit tekoälyvesileiman kiertämiseksi, tuo neuvo tähtää johonkin jota täällä ei ole.

Sen sijaan menetelmä muuttaa sitä, miten malli valitsee sanoja.

Kun kielimalli tuottaa tekstiä, se muodostaa todennäköisyysjakauman seuraavasta tokenista ja poimii siitä otoksen. SynthID-Text puuttuu peliin juuri tuossa vaiheessa. Liukuva ikkuna viimeisimmistä tokeneista, tyypillisesti neljästä, tiivistetään yhdessä salaisen vesileima-avaimen kanssa siemenluvuksi. Tuo siemenluku ohjaa joukkoa näennäissatunnaisia pisteytysfunktioita, g-funktioita. Algoritmi poimii ehdokastokeneita ja ajaa ne useiden turnauskerrosten läpi: kukin kerros pisteyttää kilpailevat ehdokkaat g-funktiolla, ja voittaja etenee. Turnauksen voittanut token on se joka tulostuu.

Tuloksena riittävän pitkällä jaksolla tulostetut tokenit korreloivat g-arvojen kanssa tavalla jota ihmisen sanavalinta ei tuottaisi. Tunnistus on tällöin tilastollinen testi: laske g-arvot uudelleen tekstin yli ja kysy, onko keskiarvo korkeampi kuin sattuma sallisi. Julkaistuja tunnistimia on kolmea lajia: tavallinen keskiarvo, painotettu keskiarvo ja bayesilainen tunnistin joka on koulutettu leimatuilla ja leimaamattomilla näytteillä, kolmikon vahvin.

Tästä rakenteesta seuraa kaksi ominaisuutta jotka selittävät lähes kaiken muun.

Ensinnäkin tunnistus ei tarvitse mallia. Gemini-tekstin tarkistamiseen ei tarvitse ajaa Geminiä. Juuri tämä tekee menetelmästä riittävän halvan otettavaksi käyttöön, ja se on todellinen edistysaskel jälkikäteen toimiviin luokittimiin nähden.

Toiseksi tunnistus tarvitsee avaimen. g-funktiot siemennetään sillä. Ilman vesileima-avainta laskemasi g-arvot eivät liity mitenkään niihin joita generoinnissa käytettiin, ja testi palauttaa kohinaa. Tämä ei ole toteutusaukko jonka joku joskus paikkaa. Se on turvaominaisuus joka estää ketään väärentämästä Googlen vesileimaa tekstiin jota Google ei ole koskaan kirjoittanut.

Koko tunnistusongelma istuu tuossa toisessa ominaisuudessa.

Kuka vesileimaa tekstiä tänään

Tilanne elokuussa 2026, rajattuna siihen minkä toimittajat itse vahvistavat:

Google Gemini. Vesileimattu siitä Nature-artikkelista lähtien joka kuvasi ensimmäisen laajan käyttöönoton, Geminissä ja Gemini Advancedissa. Googlen työntekijät vahvistivat virallisella kehittäjäfoorumilla, että myös Gemini APIn, Google AI Studion ja Antigravityn kautta tuotettu teksti on vesileimattu. Tuo vastaus tuli ensimmäisen, päinvastaisen ja virheellisen vastauksen jälkeen, mikä kertoo kohtuullisen hyvin kuinka ohuesti asia on dokumentoitu.

Anthropic Claude. Käytössä maailmanlaajuisesti 14. elokuuta 2026 alkaen niissä Claude-malleissa jotka julkaistiin 2. elokuuta 2026 tai sen jälkeen, vanhemmat mallit seuraavat perässä. Anthropic kuvaa sen SynthID-Text-lähestymistavan versioksi ja johtaa idean Scott Aaronsonin vuoden 2022 ehdotukseen. Lisäksi Anthropic liittää allekirjoitetut C2PA-todistukset tuotettuihin kuvatiedostoihin, mikä on eri mekanismi.

OpenAI. Ei tekstivesileimaa. OpenAI rakensi sellaisen, Wall Street Journalin vuonna 2024 mukaan hyvin tarkan, ja jätti sen laatikkoon. Esitetyt varaukset olivat, että se kesti huonosti käännöstä ja kokonaisvaltaista uudelleenkirjoitusta, ja että se saattaisi merkitä suhteettoman usein niitä joiden äidinkieli ei ole englanti. C2PA Content Credentials -tiedot OpenAI kyllä liittää tuottamiinsa kuviin.

Kaikki muut. Avoimin painoin jaetut mallit eivät kanna mitään leimaa, ellei niiden ajaja lisää sitä, eikä mikään estä häntä poistamasta sitä. Tämä on se rakenteellinen aukko jonka Nature-artikkeli itse nimeää: vesileimaus toimii vain siellä missä toimittajat tekevät yhteistyötä, eikä avoimia malleja voi pakottaa yhteistyöhön.

Se että molemmat käyttöönotot osuvat 2. elokuuta 2026 ei ole sattumaa. Se on päivä jona tekoälyasetuksen 50 artikla tuli sovellettavaksi.

Työkalut jotka ovat olemassa, ja mihin kukin kelpaa

Tämä osa kannattaa tehdä huolella, sillä aiheen hakutulokset ovat pahasti saastuneet.

google-deepmind/synthid-text GitHubissa. Nature-artikkelin viitetoteutus, Apache 2.0. Se vesileimaa ja tunnistaa, ja siinä on bayesilaisen tunnistimen koulutuskoodi. Se tukee Gemmaa ja GPT-2:ta mixin-luokkien kautta. README sanoo suoraan että tämä on tutkimuksen toistettavuutta varten, että mixinit eivät ole tuotantoon suunniteltuja ja että tiivistefunktio ei anna mitään kryptografisia turvatakuita. Hyödyllinen, rehellinen, eikä tunnistin muiden tekstille.

Hugging Face Transformers. Tuotantokelpoinen polku jota Google osoittaa. SynthIDTextWatermarkingConfig ja SynthIDTextWatermarkLogitsProcessor antavat tuottaa vesileimattua tekstiä hallitsemastasi mallista antamalla avainlistan ja n-grammin pituuden. Jos avaimet ovat sinulla, voit tunnistaa. Tämä on ainoa reitti jolla tavallinen kehitystiimi saa tänään tekstin vesileimauksen toimimaan päästä päähän, ja se kattaa vain oman järjestelmäsi tuottaman tekstin.

MarkLLM. THU-BPM:n akateeminen työkalupakki joka toteuttaa monta vesileima-algoritmia yhden rajapinnan taakse, muun muassa KGW:n, Unigramin, EXP:n ja SynthID-Textin keskiarvo-, painotettu keskiarvo- ja bayesilaisine tunnistimineen. Jos vertailet menetelmiä sen sijaan että ottaisit yhden käyttöön, aloita tästä.

SynthID Detector -portaali. Googlen lataa ja tarkista -työkalu, avattu varhaisille testaajille I/O:ssa toukokuussa 2026 jonotuslistan kautta toimittajille, tutkijoille ja media-alan väelle. Googlen oma varmennusta koskeva ohjedokumentaatio mainitsee kuvat, videon ja äänen. Tekstiä ei ole listalla, ja kehittäjäfoorumin ketju API-vesileimauksesta toteaa suoraan ettei portaali ota sitä vastaan.

Googlen Content Detection API. Esikatselussa vuonna 2026 Gemini Enterprise -alustalla nimetyille kumppaneille, joihin kuuluvat Shutterstock, Snap, Canva ja Fox Sports. Vain kuvat, JPEG, PNG ja WebP. Ei tekstiä, ei yleisen saatavuuden päivää, ei julkaistuja hintoja.

Anthropicin tunnistusrajapinta. Ilmoitettu tulevaksi, ilman aikataulua ja ilman toteutusyksityiskohtia. Kun se tulee, se vastaa oletettavasti Claude-tekstistä eikä mistään muusta.

C2PA Content Credentials. Ei lainkaan vesileima, ja pikemminkin täydentävä kuin kilpaileva. Kyse on kryptografisesti allekirjoitetusta alkuperämetatiedosta: kuka tämän teki, millä työkalulla, milloin, ja oliko tekoälyjärjestelmä mukana, kirjattuna kenttään digitalSourceType. Versio 2.3 lisäsi manifestit pelkille tekstidokumenteille, mikä on uutta ja olennaista. Heikkous on vesileiman heikkouden peilikuva: metatieto katoaa kopioinnissa ja liittämisessä, ja juuri niin teksti liikkuu.

Ja sitten on se mikä ei ole työkalu.

Iso joukko sivustoja sijoittuu haulla ”SynthID detection API” ja kuvaa tuotetta jonka otat käyttöön Google Cloud Consolessa, pyyntökohtaisella hinnalla ja alle sekunnin tekstiviiveellä. Tällaista tuotetta ei löydy Google Cloudin dokumentaatiosta. Vähintään yksi noista sivustoista on sisältömarkkinointia vesileimojen poistopalvelulle. Erikseen: sivustot jotka tarjoutuvat tarkistamaan tekstin SynthIDin varalta ajavat tilastollisia tekoälytunnistimia, jotka eivät lue vesileimaa eivätkä voi lukea, koska avainta ei ole. Ne pisteyttävät tekstiä ennustettavuuden ja rytmin perusteella. Se on eri asia saman sanan puvussa.

Kuinka hyvin se toimii

Rehellinen vastaus on että se toimii hyvin pitkällä, muokkaamattomalla ja korkean entropian tekstillä ja heikkenee nopeasti noiden ehtojen ulkopuolella. Luvut ovat julkisia eivätkä ne imartele.

Pituus. Tunnistus on tilastollinen testi, joten näyttö kertyy tokenien myötä. Vuonna 2026 julkaistu SynthID-Textin teoreettinen analyysi asettaa tunnistuksen noin 0,3 oikeiden positiivisten osuuteen yhden prosentin väärien positiivisten tasolla 50 tokenin teksteillä, ja tekee omat kokeensa 100:sta 400:aan tokeniin ulottuvilla jaksoilla. Sosiaalisen median päivitys, tuotekuvaus tai tukivastaus ei ole tarpeeksi tekstiä.

Entropia. Vesileima elää mallin valinnanvapaudesta. Siellä missä oikeita vastauksia on vain yksi, ei ole tilaa koodata mitään. Anthropic sanoo tämän suoraan: merkki on harvempi asiapitoisissa jaksoissa ja koodissa, jossa syntaksin ja laskennan on oltava täsmällisiä. Pyydä mallia korjaamaan kielioppisi, ja vesileima mahtuu vain kouralliseen korjauksia, mikä voi olla liian vähän rekisteröityäkseen.

Uudelleenmuotoilu. Tämä on heikko kohta. Robustisuusarvio havaitsi SynthIDin oikeiden positiivisten osuuden putoavan 0,998:sta puhtaalla tekstillä 0,498:aan maltillisessa parafraasissa. ETH Zürichin SRI Lab raportoi yli 90 prosentin onnistumisen poistossa tavallisella parafraasilla, lähes 100 prosenttiin vesileiman varastamisen avustamana, ja huomauttaa että turnausotanta, turvaominaisuudeksi tarkoitettu, tekee tokenien vahvistamisesta herkempää uudelleenkirjoituksille ja siten vähemmän kestävää kuin yksinkertaisemmat menetelmät. Vuoden 2026 arvio rikosteknisiä standardeja vasten mittasi 98,3 prosentin poiston merkityksen säilyttävällä parafraasilla, semanttisen samankaltaisuuden pysyessä noin 0,83:ssa.

Väärät positiiviset. Sama rikostekninen arvio mittasi 5,4 prosentin väärien positiivisten osuuden puhtaalla ihmisen kirjoittamalla tekstillä, 93,6 prosentin tuomion epävakauden pienillä tunnistuskynnyksen muutoksilla, ja löysi konekirjoitustestin vakiolauseen joka ylitti kynnyksen. Johtopäätös: yksikään kolmesta tutkitusta menetelmästä, KGW, Unigram ja SynthID-Text, ei täytä useampaa kuin kahta viidestä Daubert-kriteeristä asiantuntijatodistelulle.

Väärentäminen. Tässä SynthID-Text kestää paremmin kuin vaihtoehdot. SRI Labin työ raportoi 4 prosentin onnistumisen väärentämisessä oletusparametreilla, kun puna-vihreillä menetelmillä luku on 80 prosenttia tai enemmän, joskin onnistuminen nousi 15 prosenttiin kun hyökkääjän kyselyt kasvoivat 30 000:sta 90 000:een. Sama työ osoitti myös että itse vesileiman olemassaolo on pääteltävissä mustan laatikon kyselyillä, joten käyttöönoton salassa pitäminen ei ole vaihtoehto.

Yhteenvetona: positiivinen tulos pitkästä jaksosta on merkityksellistä näyttöä. Negatiivinen tulos ei tarkoita juuri mitään, koska se sopii yhtä hyvin ihmisen kirjoittamaan tekstiin, leimaamattomaan malliin, lyhyeen näytteeseen tai parafraasiin. Kenen tahansa joka rakentaa tähän työnkulun on sisäistettävä tuo epäsymmetria ennen käyttöliittymän piirtämistä.

Mitä laki pyytää

Kolme säännöstöä vaatii nyt jotain tällä alueella, eikä yksikään osu täsmälleen siihen mitä on käytössä.

Tekoälyasetus, 50 artiklan 2 kohta. Synteettistä ääntä, kuvaa, videota tai tekstiä tuottavien tekoälyjärjestelmien tarjoajien on merkittävä tuotokset koneluettavassa muodossa siten että ne voidaan tunnistaa keinotekoisesti tuotetuiksi. Merkinnän on oltava vaikuttava, yhteentoimiva, luotettava ja kestävä siinä määrin kuin se on teknisesti toteutettavissa. 50 artikla tuli sovellettavaksi 2. elokuuta 2026, ja merkintä- ja etikettivaatimukset osuvat 2. joulukuuta 2026, jolloin päättyy myös siirtymäaika järjestelmille jotka olivat markkinoilla ennen 2. elokuuta 2026. Käytännesäännöt osoittavat kerroksellista lähestymistapaa jossa yhdistyvät metatieto, vesileimaus ja lokitus. Ne eivät mainitse C2PA:ta nimeltä, mutta kuvaavat standardin ominaisuudet niin läheltä että tarkkailijat ovat panneet merkille C2PA:n olevan tällä hetkellä ainoa käyttöön otettu tekniikka joka sopii. 50 artiklan laajemman kuvan käsittelimme tekoälyasetuksen avoimuusvelvoitteiden oppaassamme.

Huomaa sana yhteentoimiva. Vesileima jonka vain sen tekijä osaa lukea sopii oudosti tuohon vaatimukseen, eikä tuota jännitettä ole ratkaistu.

Kiina. Tekoälyn tuottaman synteettisen sisällön merkintäsäännöt tulivat voimaan 1. syyskuuta 2025 ja ovat kolmikon konkreettisimmat. Ne vaativat sekä eksplisiittisen, käyttäjälle näkyvän merkinnän että implisiittisen merkinnän tiedoston metatiedoissa. Teksti kuuluu soveltamisalaan. Alustojen on tarjottava merkintätoiminnot, ja tekoälyn tuottamaa sisältöä julkaisevien käyttäjien on ilmoitettava siitä.

Kalifornia. AI Transparency Act, SB 942 sellaisena kuin se on muutettuna AB 853:lla, on ollut voimassa 2. elokuuta 2026 alkaen tarjoajille joilla on yli miljoona kuukausikäyttäjää. Se vaatii ilmaisen tunnistustyökalun, näkyvän ilmoituksen ja upotetun piilevän ilmoituksen jossa on tarjoajan nimi, järjestelmän nimi ja versio, aikaleima ja yksilöivä tunniste. Lue soveltamisala tarkkaan: piilevän ilmoituksen velvoite koskee kuvaa, videota ja ääntä. Teksti ei ole mukana. 1. tammikuuta 2027 alkaen suurten verkkoalustojen on näytettävä alkuperätiedot eivätkä ne saa tietoisesti poistaa niitä.

Kuvio on kaikissa kolmessa sama. Laki pyytää merkkejä jotka voi tunnistaa, ja käyttöön otetut tekstimerkit voi tunnistaa vain niiden tekijä. Joko tunnistus avautuu, tai tekstivelvoitteet täytetään C2PA-tyyppisellä metatiedolla joka ei käytännössä koskaan selviä kopioinnista.

Mitä tämä tarkoittaa jos rakennat ohjelmistoja

Suurin osa tästä ei ole vaatimustenmukaisuusprojekti. Se on kourallinen teknisiä päätöksiä jotka ovat halpoja nyt ja kalliita jälkiasentaa.

Älä osta tunnistinta tuomioksi. Jos toimittaja väittää tunnistavansa SynthIDin mielivaltaisesta tekstistä, hän ei pysty, ja häneltä kannattaa pyytää avainta. Jos ajat jo tekoälytunnistusta käyttäjien lähetyksiin, kohtele pistemäärää triage-signaalina joka ohjaa ihmiselle, älä koskaan päätelmänä. Näyttö seurauksellista käyttöä vastaan on vahva: Stanfordin tutkimus havaitsi tunnistimien luokittelevan virheellisesti tekoälyn tuottamiksi yli puolet muiden kuin äidinkielisten kirjoittajien TOEFL-esseistä, ja yhä useampi yliopisto on kytkenyt työkalut pois sen jälkeen kun ne merkitsivät ihmisen tekemää työtä sadan prosentin varmuudella. Käytännön rakentaminen sen päälle on vastuuriski, ei kontrolli.

Lopeta alkuperämetatietojen poistaminen. Tämä on yleisin itse aiheutettu haava. Kuvaputket koodaavat uudelleen, skaalaavat ja normalisoivat rutiininomaisesti, ja useimmat heittävät matkalla pois C2PA-manifestit ja XMP:n. 50 artiklan 2 kohdan valossa juuri sinä poistat merkinnän jonka laki haluaa säilyvän, ja tammikuusta 2027 alkaen se on Kaliforniassa alustan velvollisuus. Käy putki läpi, säilytä manifesti tai allekirjoita uudelleen muunnoksen jälkeen. Nyt kun C2PA 2.3 tukee pelkkiä tekstidokumentteja, sama kuri on tulossa myös tekstiin.

Pidä omaa alkuperäkirjanpitoa. Tämä on se osa joka oikeasti toimii. Teki vesileima mitä tahansa, järjestelmäsi tietää mikä malli tuotti mitä, milloin, millä kehotteella ja kuka tarkasti. Tallenna se tietueen kenttänä. Se on näyttö 50 artiklan ihmisen tekemän tarkastuksen poikkeuksesta, se on se minkä ojennat viranomaiselle tai asiakkaalle, eikä se riipu siitä julkaiseeko kukaan rajapintaa.

Jos isännöit itse, saat koko silmukan. Tiimi joka ajaa omaa malliaan Hugging Face Transformersilla voi vesileimata generoinnissa ja tunnistaa myöhemmin, koska avaimet ovat sillä. Jos tuotat sisältöä paljon ja sinun on tunnistettava oma tuotoksesi myöhemmin, tämä on saatavilla tänään eikä kukaan myy sitä sinulle.

Kysy toimittajilta oikea kysymys. Ei ”vesileimaatteko”, johon vastaus on nykyään useimmiten kyllä eikä se kerro mitään. Kysy onko merkki sinun luettavissasi vai vain heidän, mitä sille tapahtuu muokkauksessa ja käännöksessä, liitetäänkö C2PA-metatietoa ja mihin muotoihin, ja mitä he sitoutuvat sopimuksessa sanomaan 50 artiklan 2 kohdasta 2. joulukuuta 2026 jälkeen.

Mihin tämä on menossa

Tekniikka on aitoa ja Nature-tulos on kunnollista insinöörityötä: vesileima joka maksaa puoli prosenttia viivettä, kestää arvioinnin noin 20 miljoonan todellisen Gemini-vastauksen yli muuttamatta mitattavasti käyttäjätyytyväisyyttä, ja joka tunnistetaan mallia koskematta. Se ei ole vähän.

Käyttöönotto on toistaiseksi myös suljettu. Kaksi toimittajaa vesileimaa tekstiä, kumpikaan ei anna kenenkään muun lukea merkkiä, kolmas rakensi sellaisen ja pani sen syrjään, ja avoimet mallit ovat kokonaan järjestelmän ulkopuolella. Kuilu sen välillä mitä merkintäsäännöt pyytävät ja mitä näiden yhtiöiden ulkopuolinen ihminen voi oikeasti todentaa on tässä se kiinnostava ongelma, eikä se ole tekninen.

Neuvomme asiakkaille on käyttää nolla tunnistukseen ja jotain alkuperään. Tunnistus jota et voi ajaa etkä uskoa ei ole kontrolli. Siisti kirjanpito siitä mitä omat järjestelmäsi ovat tuottaneet, ja aineistoputki joka lakkaa tuhoamasta jo liitettyä metatietoa, on työtä jota hallitset itse, ja juuri siihen 2. joulukuuta 2026 määräaika oikeasti koskee. Missä tämä sijaitsee kaiken muun joukossa vuoteen 2028 asti, kerrotaan EU:n digitaalisen vaatimustenmukaisuuden oppaassamme 2026.

Rakennamme tekoälyominaisuuksia Euroopassa toimivien yritysten tuotteisiin, mikä tarkoittaa että alkuperäkentät, tunnukset säilyttävät aineistoputket ja jäljitysketjut kuuluvat normaaliin toimitukseen eivätkä erilliseen harjoitukseen. Jos haluat katsauksen siihen mistä tekoälyn tuottama sisältö tulee tuotteeseesi ja mitä sen alkuperälle tapahtuu matkalla ulos, kirjoita osoitteeseen office@c9group.dev.

Olemme insinöörejä, emme juristeja. Se osuuko tietty velvoite sinuun tarjoajana vai käyttöönottajana kuuluu lakimiehellesi. Me huolehdimme siitä että järjestelmä vastaa vastausta.