Rankaiseeko Google tekoälyllä kirjoitettua sisältöä?
Ei pelkästään sen vuoksi, että teksti on kirjoitettu tekoälyllä. Googlen linjauksen mukaan tekoälyn tai automaation asianmukainen käyttö ei ole sen ohjeiden vastaista, ja se palkitsee laadukasta sisältöä riippumatta siitä, miten sisältö on tuotettu. Raja menee käyttötarkoituksessa: jos automaatiota, tekoäly mukaan lukien, käytetään sisällön tuottamiseen ensisijaisesti hakusijoitusten manipuloimiseksi, se rikkoo Googlen roskapostikäytäntöjä.
Linjaus julkaistiin Googlen hakublogissa helmikuussa 2023, ja sama ajatus kulkee Googlen ohjeissa edelleen. Google ei kysy, kuka tai mikä tekstin kirjoitti. Se kysyy, onko teksti hyödyllistä ja onko se tehty ihmisiä vai hakukonetta varten.
Yritykselle vastaus on sekä helpottava että vaativa. Helpottava, koska tekoälyn käyttö ei ole kiellettyä eikä sitä tarvitse piilotella. Vaativa, koska tekoäly tekee keskinkertaisen tekstin tuottamisesta niin helppoa, että juuri keskinkertaisuudesta tulee riski.
Mitä Googlen ohjeet sanovat automaattisesta sisällöstä?
Googlella on erillinen ohje generatiivisen tekoälyn käytöstä sivuston sisällössä, jota on päivitetty viimeksi joulukuussa 2025. Sen ydin on lyhyt: kun sisältöä tuotetaan automaattisesti, huomio pitää olla tarkkuudessa, laadussa ja osuvuudessa.
Ohje ulottuu myös tekstin ympärille. Otsikot, metakuvaukset, rakenteinen tieto ja kuvien vaihtoehtoiset tekstit kuuluvat samaan vaatimukseen, vaikka ne olisi tuotettu automaattisesti. Tekoälyn keksimä metakuvaus, joka ei vastaa sivun sisältöä, on yhtä lailla virhe kuin väärä tieto leipätekstissä.
Lisäksi ohjeessa todetaan, että tieto siitä, miten sisältö on tehty, voi antaa lukijalle hyödyllistä taustaa. Se ei ole määräys merkitä jokaista lausetta, vaan kehotus kertoa asiasta, kun lukija voisi perustellusti kysyä, miten teksti on syntynyt.
Verkkokaupoille ohjeessa on tarkempi vaatimus: tekoälyllä tuotetuissa kuvissa pitää olla kuvatiedoston metatiedoissa merkintä, joka kertoo kuvan olevan algoritmin tuottama. Muut tekoälykuviin liittyvät kysymykset, kuten oikeudet ja luottamus, on käyty läpi oppaassa tekoälykuvista yrityksen markkinoinnissa.
Massasisällön väärinkäyttö: tässä kohdassa raja menee
Googlen roskapostikäytännöissä on kohta, joka koskee suoraan tekoälyllä tuotettua sisältöä: massasisällön väärinkäyttö. Sillä tarkoitetaan tilannetta, jossa sivuja tuotetaan paljon ensisijaisesti hakusijoitusten manipuloimiseksi eikä käyttäjien auttamiseksi.
Käytäntöjen esimerkeissä mainitaan muun muassa nämä:
- generatiivisen tekoälyn tai vastaavien työkalujen käyttäminen monien sivujen tuottamiseen ilman, että ne tuovat käyttäjälle lisäarvoa
- syötteiden, hakutulosten tai muun sisällön kaapiminen uusiksi sivuiksi esimerkiksi synonyymeillä tai kääntämällä, kun lukija saa niistä vähän arvoa
- eri sivujen sisällön yhdistely ilman lisäarvoa
- useiden sivustojen perustaminen, jotta sisällön massatuotanto ei näkyisi
- sivut, joissa on hakusanoja mutta joiden sisällössä ei ole lukijalle juuri mitään järkeä
Huomaa, mitä listalla ei ole. Siinä ei lue, että tekoälyn käyttö sinänsä olisi väärinkäyttöä. Ratkaisevaa on suuri määrä yhdistettynä siihen, ettei sivuista ole hyötyä. Koko lista on luettavissa Googlen roskapostikäytännöissä.
Miltä massasisältö näyttää pienen yrityksen sivuilla
Pienen yrityksen sivuilla massasisältö ei yleensä näytä roskapostilta. Se näyttää ahkeruudelta. Siksi siihen on helppo päätyä vahingossa, varsinkin kun joku tarjoaa sitä palveluna.
Tyypillisiä esimerkkejä ovat nämä:
- Kaupunkisivut. Sata sivua muotoa "Putkimies Hämeenlinna" ja "Putkimies Riihimäki", joissa teksti on sama ja vain kaupungin nimi vaihtuu, vaikka yritys ei toimi puolessakaan niistä.
- Blogi yhdessä iltapäivässä. Viisikymmentä artikkelia hakusanalistan pohjalta, jokainen yleinen tiivistelmä aiheesta, jota yritys ei tunne erityisen hyvin.
- Tuotekuvaukset uusiksi. Valmistajan tekstit muotoiltu tekoälyllä toisenlaisiksi ilman yhtään tietoa, jota valmistajan sivulla ei jo ole.
- Käännökset ilman lukijaa. Koko sivusto koneellisesti viidelle kielelle, eikä kukaan ole lukenut käännöksiä.
Kaikissa on sama kaava: paljon sivuja, vähän omaa. Lukijalle niistä ei ole hyötyä, ja ne ovat lähellä sitä, mitä roskapostikäytäntö kuvaa. Pahimmillaan roskapostiksi katsottu sivusto voi pudota hakutuloksissa tai kadota niistä kokonaan.
Voiko tekoälytekstin tunnistaa luotettavasti?
Ei voi. Tekoälytekstin tunnistimet antavat arvion todennäköisyydestä eivätkä todistetta, ja ne erehtyvät molempiin suuntiin: ihmisen kirjoittama teksti voi saada korkean tekoälyarvion ja tekoälyn kirjoittama matalan. Kuvaava esimerkki on OpenAI, joka julkaisi oman tunnistimensa vuoden 2023 alussa ja poisti sen käytöstä saman vuoden heinäkuussa, koska sen tarkkuus oli heikko.
Tunnistimen tulos myös muuttuu helposti. Kun tekoälyn luonnosta muokataan käsin, lauseita yhdistellään tai teksti ajetaan toisen työkalun läpi, arvio voi kääntyä täysin, vaikka sisältö pysyy samana. Kun taas ihminen kirjoittaa asiallisen, selkeän ja tavanomaisen tekstin, se voi näyttää tunnistimelle koneen tuottamalta.
Siksi tunnistimen prosenttiluku ei kelpaa perusteeksi millekään tärkeälle päätökselle. Se ei riitä syyttämään kirjoittajaa, eikä se riitä todistamaan, että teksti on ihmisen tekemä.
Miksi tunnistimet erehtyvät
Tunnistin ei näe, miten teksti on syntynyt. Se näkee vain valmiin tekstin ja arvioi, muistuttaako se tilastollisesti sitä, mitä kielimallit tavallisesti tuottavat.
Kielimalli taas kirjoittaa todennäköisiä lauseita. Se valitsee sanoja, jotka sopivat yhteen tavanomaisella tavalla. Ongelma on, että moni ihminen kirjoittaa samalla tavalla, erityisesti virallisessa ja asiallisessa tekstissä. Tilitoimiston palvelukuvaus tai sopimusteksti on luonnostaan ennustettavaa, koska sen kuuluukin olla.
Lisäksi yhä useampi teksti on sekoitus. Ihminen kirjoittaa rungon, tekoäly korjaa kieliasun, ihminen lisää esimerkit ja tekoäly tiivistää. Tällaiselle tekstille ei ole oikeaa vastausta kysymykseen, onko se tekoälyn kirjoittama.
Mitä tunnistimen tulos ei kerro
Tärkein asia, jota tunnistin ei kerro, on se, pitääkö teksti paikkansa. Kokonaan ihmisen kirjoittamassa tekstissä voi olla vääriä hintoja ja vanhentuneita ohjeita, ja tekoälyn avulla tehty teksti voi olla huolellisesti tarkistettu ja oikea.
Jos ostat tekstejä ulkopuoliselta kirjoittajalta, tunnistin on siksi väärä työkalu laadun valvontaan. Parempi tapa on sopia etukäteen, saako tekoälyä käyttää, kuka vastaa tietojen tarkistamisesta ja mitä tapahtuu, jos tekstissä on virheitä. Sen jälkeen arvioit tekstiä sillä, mikä ratkaisee: pitävätkö tiedot paikkansa, onko siinä jotain omaa ja palveleeko se asiakasta.
Sama pätee omaan henkilökuntaan. Työntekijän tekstin ajaminen tunnistimen läpi ja johtopäätösten tekeminen prosenttiluvusta on varma tie riitaan, jossa kummallakaan osapuolella ei ole näyttöä.
Tunnistaako Google tekoälytekstin?
Googlen julkiset ohjeet eivät perustu siihen, onko teksti tekoälyn kirjoittamaa. Ne arvioivat sisällön laatua ja tarkoitusta: onko sivu hyödyllinen ja onko sivuja tehty massana hakusijoitusten vuoksi. Ohjeiden näkökulmasta ratkaisevaa ei ole se, kuka tai mikä tekstin kirjoitti, vaan se, täyttääkö sivu roskapostin tunnusmerkit.
Roskapostin torjuntaan Googlella on omat automaattiset järjestelmänsä, kuten tekoälyyn perustuva SpamBrain, johon se viittasi myös tekoälysisältöä koskevassa linjauksessaan. Sivuston omistajan ei kuitenkaan tarvitse arvailla niiden toimintaa, koska ohjeet kertovat, mitä vältetään.
Käytännössä kysymys siitä, tunnistaako Google tekoälytekstin, on siis väärä kysymys. Oikea kysymys on, näyttääkö sivustosi sisältö siltä, että se on tehty lukijaa varten. Jos näyttää, tekoälyn käyttö ei ole ongelma. Jos ei näytä, ihmisen kirjoittamakaan teksti ei pelasta sitä.
Miten tekoälyä käytetään sisällössä niin, että siitä on hyötyä?
Tekoälystä on hyötyä, kun sisältö tulee sinulta ja tekoäly auttaa muodossa. Tieto, kokemus, esimerkit ja päätökset ovat omia. Rakenne, kieliasu, tiivistäminen ja luonnostelu voivat olla tekoälyn apua.
Hyviä käyttötapoja ovat esimerkiksi nämä:
- Omista muistiinpanoista luonnos. Sanelet puhelimeen, miten asennus käytännössä etenee, ja tekoäly järjestää sen luettavaksi tekstiksi.
- Asiakkaiden kysymyksistä usein kysytyt kysymykset. Kokoat sähköposteista toistuvat kysymykset ilman henkilötietoja, pyydät niistä jäsennellyn listan ja kirjoitat vastaukset itse.
- Oman tekstin selkeyttäminen. Kirjoitat kömpelön mutta oikean tekstin, ja tekoäly ehdottaa selkeämpää muotoilua.
- Otsikkovaihtoehdot. Pyydät kymmenen versiota otsikosta ja valitset niistä sen, joka kertoo rehellisimmin, mitä artikkelissa on.
- Rakenteen tarkistus. Kysyt, mitä lukija voisi vielä haluta tietää, ja päätät itse, onko ehdotuksissa jotain aiheellista.
Kaikissa näissä tekoäly nopeuttaa työtä, jota sinä ohjaat. Yhdessäkään se ei korvaa sitä, mitä vain sinä tiedät. Sama periaate toimii, kun tekoälyä käytetään yrityksen apuna muussakin arjessa kuin sisällöissä.
Työnkulku, jolla teksti pysyy omana
Kun tekoälyä käytetään sisällön tekemiseen säännöllisesti, sovittu järjestys säästää virheiltä. Tämä toimii useimmissa pienissä yrityksissä:
- Kerää oma aineisto ensin: muistiinpanot, asiakkaiden kysymykset, kuvat ja luvut.
- Pyydä tekoälyltä rakenne ja luonnos tämän aineiston pohjalta, ei tyhjästä.
- Lisää esimerkit, havainnot ja kokemukset itse.
- Tarkista jokainen tieto, luku ja lupaus.
- Lue teksti kerran ääneen ja korjaa kohdat, jotka eivät kuulosta sinulta.
- Julkaise teksti kirjoittajan tai tarkistajan nimellä.
Järjestyksessä olennaisin on ensimmäinen kohta. Kun tekoäly saa lähtökohdaksi oman aineistosi, lopputulos on sinun tekstisi paremmassa muodossa. Kun se kirjoittaa tyhjästä, lopputulos on sama yleisteksti, jonka kuka tahansa kilpailija saa samalla pyynnöllä. Oma kokemus ja nimetty kirjoittaja ovat myös juuri niitä asioita, joita Googlen E-E-A-T-ajattelu korostaa.
Mitä ihmisen pitää aina tarkistaa?
Ihmisen pitää aina tarkistaa kaikki, mikä voi olla väärin tavalla, josta on haittaa: luvut, päivämäärät, hinnat, nimet, lakiviittaukset ja lupaukset. Tekoäly kirjoittaa niitä yhtä sujuvasti silloin, kun se tietää, ja silloin, kun se arvaa, eikä tekstistä näe eroa.
Käy nämä läpi ennen julkaisua:
- Luvut ja päivämäärät. Pitääkö jokainen luku paikkansa, ja mistä se on peräisin?
- Hinnat ja ehdot. Vastaavatko ne sitä, mitä yritys oikeasti veloittaa ja lupaa?
- Lait ja viranomaisten ohjeet. Onko viittaus oikeaan lakiin, ja onko tieto voimassa? Tarkista se aina alkuperäisestä lähteestä.
- Nimet ja tuotteet. Onko ohjelmistojen, laitteiden ja palveluiden nimet kirjoitettu oikein, ja ovatko ne ylipäätään olemassa?
- Linkit. Johtavatko ne oikeille sivuille, ja onko sivuja olemassa?
- Väitteet muista. Tekoäly voi kirjoittaa kilpailijasta tai alasta asioita, joita kukaan ei ole tarkistanut.
Tekoälyn taipumus keksiä uskottavia yksityiskohtia on oma aiheensa, ja se on käsitelty artikkelissa miksi tekoäly keksii asioita.
Lupaukset ja ehdot ovat vaarallisimmat virheet
Väärä vuosiluku on nolo. Väärä lupaus on kallis. Jos tekoäly kirjoittaa palvelusivulle "toimitus seuraavana arkipäivänä" tai "kolmen vuoden takuu", eikä yritys tarjoa kumpaakaan, asiakas lukee sen yrityksen lupauksena.
Tällaiset virheet syntyvät helposti, koska ne kuulostavat tavallisilta. Tekoäly on nähnyt valtavan määrän palvelusivuja, joilla lukee juuri noin, ja se täydentää tekstiä sillä, mikä on alalla tyypillistä, eikä sillä, mitä sinun yrityksesi tekee.
Markkinoinnissa annettujen tietojen pitää pitää paikkansa riippumatta siitä, kuka tai mikä ne kirjoitti. Kuluttajille markkinoitaessa vaatimukset tulevat kuluttajansuojalaista, ja niiden noudattamista valvoo Kilpailu- ja kuluttajavirasto, jonka ohjeista tarkat säännöt kannattaa tarkistaa. Vastuu on aina yrityksellä, ei työkalulla.
Pitääkö tekoälyn käytöstä kertoa lukijalle?
Googlen ohjeen mukaan tieto siitä, miten sisältö on tehty, voi antaa lukijalle hyödyllistä taustaa, varsinkin kun lukija voisi perustellusti ihmetellä sitä. Googlen ohjeet eivät vaadi tavalliseen tekstiin erillistä merkintää, mutta avoimuus on luottamuksen kannalta usein järkevä valinta.
Käytännössä kertominen ei tarkoita varoitustarraa jokaisen kappaleen alle. Useimmiten riittää, että kerrot, kuka tekstin on kirjoittanut tai tarkistanut, ja tarvittaessa lyhyesti, miten tekoälyä on käytetty, esimerkiksi käännöksen luonnoksessa tai tiivistelmässä.
Lainsäädäntö on oma kysymyksensä. EU:n tekoälyasetuksessa on avoimuusvelvoitteita, ja niiden soveltuminen riippuu siitä, millaista sisältöä tuotetaan ja mihin tarkoitukseen. Pienen yrityksen näkökulmasta ne on käyty läpi artikkelissa EU:n tekoälyasetuksesta pienelle yritykselle, ja asetuksen virallinen teksti löytyy EU:n säädöstietokannasta.
Mitä tehdä, jos sivuilla on jo paljon tekoälytekstiä
Jos sivustolle on jo tuotettu paljon tekoälytekstiä, kaiken poistaminen kerralla ei ole ratkaisu. Aloita selvittämällä, mitkä sivut toimivat ja mitkä eivät.
Search Console näyttää jokaisen sivun näyttökerrat ja klikkaukset. Sivut, jotka eivät ole saaneet puolen vuoden aikana juuri yhtään näyttökertaa, eivät palvele ketään, ja ne ovat ensimmäiset ehdokkaat parantamiselle, yhdistämiselle tai poistamiselle. Sivut, jotka tuovat kävijöitä ja yhteydenottoja, tarkistetaan ensin, koska niiden virheillä on eniten lukijoita.
Parantaminen tarkoittaa samaa kuin uuden tekstin kohdalla: omat esimerkit, tarkistetut tiedot ja selvä syy olla olemassa. Kymmenen samankaltaista sivua kannattaa usein yhdistää yhdeksi hyväksi. Järjestys on sama kuin vanhan sisällön päivittämisessä: ensin luvut, sitten päätös ja vasta lopuksi kirjoittaminen.
Yhteenveto
Google ei rankaise tekstiä siitä, että se on kirjoitettu tekoälyllä. Sen ohjeiden mukaan tekoälyn asianmukainen käyttö on sallittua, ja raja kulkee siinä, tuotetaanko sivuja massana hakusijoitusten vuoksi ilman hyötyä lukijalle. Tätä Google kutsuu massasisällön väärinkäytöksi.
Tekoälytekstin tunnistaminen ei ole luotettavaa. Tunnistimet erehtyvät molempiin suuntiin, ja jopa OpenAI poisti oman tunnistimensa käytöstä heikon tarkkuuden vuoksi. Prosenttiluku ei kerro, pitääkö teksti paikkansa, ja juuri se on tärkein kysymys.
Käytä tekoälyä muotoon ja nopeuteen, ja pidä sisältö omana. Tarkista luvut, hinnat, lait ja lupaukset joka kerta, ja julkaise teksti nimellä, joka vastaa siitä.
