Näin tekoälyn tuottamaan tekstiin lisätty vesileima-tunniste toimii
Sekä Euroopan Unionin että Kalifornian osavaltio vaativat nyt sen, että tekoälyllä tuotettu sisältö pitää pystyä tunnistamaan ja se pitää merkitä selkeästi tekoälyn luomaksi.
Eli kyseessä ei ole pelkästään EU:n keksintö, vaan täsmälleen vastaava vaatimus on myös Yhdysvaltain väkirikkaimmassa osavaltiossa, Kaliforniassa.
Ja tekoälyfirmat ovat jo kertoneet, että ne ovat ryhtyneet toimiin vaatimusten toteuttamiseksi. Kuviin, videoihin ja ääneen lisätään ns. digitaalinen vesileima, jonka pystyy ohjelmallisesti tunnistamaan tiedostosta, vaikka se ei varsinaisesti kuvassa tai videossa näkyisikään - tai kuuluisi äänessä.
Mutta enemmän hämmennystä on aiheuttanut se, että tekoälyfirmat merkitsevät myös tekoälyn tuottamat tekstit digitaalisella tunnisteella. Esimerkiksi Anthropic on jo kertonut, että kaikki sen Claude-tekoälyn tuottamat tekstit sisältävät digitaalisen tunnisteen Euroopan Unionin alueella 2.8.2026 alkaen.
Moni nenäkäs kommentoija saattaa hymähtää tähän niin, että tekoälyn tuottaman tekstinhän tunnistaa helposti. Mutta näinhän ei oikeasti ole, vaan fiksuilla prompteilla ja kehittyneimmillä tekoälymalleilla tuotettua tekstiä on käytännössä mahdotonta tunnistaa varmuudella tekoälyn tuottamaksi.
Mutta EU vaatii, että myös teksti on pakko pystyä tunnistamaan tekoälyllä tehdyksi.
Miten ihmeessä se sitten onnistuu? Anthropic nimittäin kertoo omissa ohjeissaan, että tekstissä oleva tunniste säilyy, vaikka tekstin kopioisi leikepöydälle ja liittäisi sen pelkkänä tekstinä tekstieditoriinkin. Yhtiön mukaan tunniste säilyy tekstissä, vaikka sitä muokattaisiinkin (vähäisessä määrin).
Ratkaisusta on käyty paljon pohdintaa netissä, mutta todennäköisin selitys piilee tavallaan salausteknologian ja tekoälymallien taustateknologian yhdistelmässä.
Kun tekoäly tuottaa tekstiä, se valitsee tietyllä logiikalla ja todennäköisyyksillä toisiaan seuraavat sanat. Säätämällä vain hieman, tietyllä, vain yhtiön tiedossa olevalla kaavalla näitä todennäköisyyksiä, rakentuu sanojen keskinäisistä suhteista perustason todennäköisyyksistä poikkeava malli, joka voidaan sitten laskea auki - ja todentaa tekstin olevan kyseisen tekoälymallin luomaa.
Ajatuksen tähän tekoälyn tuottaman tekstin "vesileimaamiseen" esitti Google jo viime vuonna, kun yhtiö julkaisi SynthID-tunnisteet. Ja nettiyhteisössä ollaan suhteellisen varmoja siitä, että Anthropicin tekstien vesileimat pohjautuvat SynthID-teknologiaan tai läheisesti sitä muistuttavaan ratkaisuun.
Anthropic itsekin puhuu "tilastollisesta kaavamaisuudesta", jolla vesileima voidaan tunnistaa pitkästäkin ja jopa jälkikäteen käsipelillä muokatusta tekstistä.
Toinen alan jätti, OpenAI on jo kertonut suoraan käyttävänsä Googlen kehittämää SynthID:tä ChatGPT:n tuottaman tekstin merkitsemiseen. Ja luonnollisesti Googlen omat Gemini-tekoälyt käyttävät jo nyt samaa teknologiaa.
Eli jatkossa tekoälyllä tuotettu teksti, jota ei ole radikaalisti muokattu jälkikäteen käsin, on täysin mahdollista tunnistaa varsin suurella varmuudella - vaikka tekstin laatu paranisi vielä nykyisestäkin tasosta.
KOMMENTOI
Haluatko kommentoida tätä artikkelia?
Kirjaudu sisään tai Luo uusi käyttäjätunnus.