Automaattinen sisällöntuotanto: laatuportit, Googlen spam-säännöt ja tämän sivuston putki
Vastaus lyhyestiGoogle ei kiellä tekoälyllä kirjoitettua tekstiä. Se kieltää sivujen massatuotannon, jonka päätarkoitus on hakusijoitusten manipulointi eikä lukijan auttaminen, tehtiin se koneella tai käsin. Raja kulkee hyödyssä: onko sivulla jotain, mitä lukija ei saa muualta, ja pitävätkö väitteet paikkansa. Tämä sivusto kirjoitetaan koneella ja ohjataan laatuportin läpi, jonka rubriikki ja hylkäykset ovat julkisia. Ihminen vastaa jokaisesta julkaisusta.
Suomessa myydään tällä hetkellä kahta vastakkaista tarinaa. Toinen sanoo, että Google rankaisee tekoälytekstistä ja että kaikki pitää kirjoittaa käsin. Toinen sanoo, että sisältökone voi kirjoittaa sata sivua yössä ja liikenne kasvaa itsestään. Googlen omat dokumentit eivät tue kumpaakaan. Tämä pilari käy läpi, mitä Google oikeasti sanoo, mikä erottaa hyödyllisen automaation spämmistä, ja miten tämä sivusto yrittää pysyä oikealla puolella rajaa kirjoittamalla itsensä koneella, julkisesti.
Google ei kiellä tekoälyä, se kieltää arvottoman massatuotannon
Googlen spämmisääntöjen kohta scaled content abuse määrittelee kielletyn toiminnan näin: “Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” Sama kappale jatkaa, että kyse on tyypillisesti suuresta määrästä epäomaperäistä sisältöä, joka antaa lukijalle vähän tai ei mitään, “no matter how it’s created”, eli riippumatta siitä, miten se on tehty. Sanamuoto on luettavissa Google Search Centralin spämmisäännöissä, jotka on päivitetty viimeksi elokuussa 2026.
Esimerkkilistan ensimmäinen kohta koskee suoraan tekoälyä: generatiivisten tekoälytyökalujen käyttö monen sivun tuottamiseen ilman lisäarvoa käyttäjille. Muut esimerkit ovat vanhempia tuttuja: syötteiden ja hakutulosten kaapiminen sivuiksi, sisällön yhdistely muilta sivuilta ilman lisäarvoa, useiden sivustojen perustaminen mittakaavan piilottamiseksi ja sivut, joissa on hakusanoja mutta ei järkeä. Tekoäly on listalla yhtenä välineenä, ei syynä.
Oleellinen sana on primary purpose, päätarkoitus. Google ei kysy, kirjoittiko tekstin ihminen vai malli, vaan onko sivu olemassa lukijaa vai hakukonetta varten. Käyn sanamuodot läpi tarkemmin artikkelissa Scaled content abuse: mitä Google oikeasti kieltää tekoälysisällössä.
Sääntö sai nykyisen muotonsa maaliskuussa 2024. Googlen The Keyword -blogin mukaan aiempi sääntö oli suunniteltu tilanteisiin, joissa automaation käyttö oli ilmeistä. Uusi sääntö laajennettiin koskemaan sisällön massatuotantoa hakusijoitusten vuoksi “whether automation, humans or a combination are involved”. Google arvioi päivityksen vähentävän heikkolaatuista, epäomaperäistä sisältöä hakutuloksissa 40 prosenttia ja kertoi huhtikuussa 2024 toteuman olleen 45 prosenttia. Nämä ovat Googlen omia lukuja omasta arviostaan, eivät riippumattomia mittauksia.
Googlen tekoälyohje sanoo saman toisin sanoin
Googlella on erillinen sivu Guidance on using generative AI content, päivitetty joulukuussa 2025. Sen linja on lyhyt: generatiivinen tekoäly on hyödyllinen aiheen tutkimiseen ja omaperäisen sisällön jäsentämiseen, mutta monen sivun tuottaminen ilman lisäarvoa voi rikkoa scaled content abuse -sääntöä.
Ohje pyytää kolmea asiaa. Ensimmäinen on tarkkuus, laatu ja relevanssi, ja se koskee erikseen myös automaattisesti tuotettuja metatietoja: title-elementtejä, meta descriptioneita, rakenteista dataa ja kuvien alt-tekstejä. Tämä on hiljainen mutta tärkeä kohta, koska sisältökoneiden yleisin näkyvä virhe on juuri templaattiotsikko, joka toistuu sadalla sivulla. Toinen on konteksti lukijalle: jos sisältöä tuotetaan automaattisesti, Google kehottaa harkitsemaan tiedon lisäämistä siitä, miten sisältö tehtiin, yleisölle mielekkäällä tavalla. Kolmas on verkkokaupan pakollinen sääntö: tekoälyllä tehdyissä kuvissa pitää olla IPTC DigitalSourceType -metatieto TrainedAlgorithmicMedia, ja tekoälyllä tuotetut tuotetiedot pitää merkitä erikseen. Se on ainoa kohta koko Googlen tekoälyohjeistuksessa, jossa merkintä on vaatimus eikä suositus.
Tekoälyhaun puolella Google sanoo saman: AI features and your website -sivun mukaan AI Overviews- ja AI Mode -näkyvyyteen ei ole lisävaatimuksia, ei erillisiä optimointeja eikä tarvetta uusille koneluettaville tiedostoille. Automaattinen sisältö arvioidaan samoilla järjestelmillä kuin kaikki muukin.
Hyödyllisen automaation ja spämmin ero on kolme kysymystä
Googlen ohjeista ja laatuarvioijien käsikirjasta voi tiivistää kolme kysymystä, jotka erottavat hyödyllisen automaattisen sisällön scaled content abusesta.
Ensimmäinen kysymys: pitääkö jokainen väite paikkansa ja voiko sen tarkistaa. Kielimalli tuottaa sujuvaa tekstiä myös silloin, kun se ei tiedä. Luku ilman lähdettä on automaattisen sisällön tyypillisin vika, ja se on myös se, mistä lukija tai kilpailija saa kiinni. Siksi tämän sivuston kirjoitusohje sanoo, että jokainen luku saa lähteen tai jää pois, ja yksikin keksitty luku hylkää artikkelin.
Toinen kysymys: onko sivulla jotain, mitä lukija ei saa kymmeneltä muulta sivulta. Google kutsuu tätä omaperäisyydeksi ja lisäarvoksi. Laatuarvioijien ohjeen (Search Quality Rater Guidelines, versio 11.9.2025) Lowest-taulukko kuvaa alimman laadun sivun näin: pääsisältö on tehty “with little to no effort, has little to no originality and the MC adds no value compared to similar pages on the web”. Kohdan 4.6.6 otsikko on sama asia pidemmin. Sama ohje määrittelee generatiivisen tekoälyn koneoppimismalliksi, joka luo uutta sisältöä oppimastaan, eli arvioijien odotetaan tunnistavan tekoälytekstin ja arvioivan sen samalla mittarilla kuin muunkin.
Kolmas kysymys: kuka vastaa. Googlen Creating helpful content -ohjeen Kuka, miten, miksi -kohta kysyy suoraan, onko automaation ja tekoälyn käyttö kävijälle ilmeistä, kerrotaanko, miten sitä käytettiin, ja selitetäänkö, miksi se nähtiin hyödylliseksi. Vastuun kysymystä käsittelen artikkelissa Tekoälyteksti ja E-E-A-T: kuka on vastuussa, kun kone kirjoittaa?.
Jos automaattinen sisältö vastaa kaikkiin kolmeen myöntävästi, se ei ole scaled content abusea Googlen määritelmän mukaan, vaikka sitä tuotettaisiin joka päivä. Jos se ei vastaa yhteenkään, se on spämmiä, vaikka joka rivi olisi kirjoitettu käsin.
Laatuportti on kone, joka tarkistaa koneen ennen ihmistä
Laatuportti tarkoittaa toista mallikutsua, joka lukee kirjoittajamallin tekstin ja pisteyttää sen ennalta sovitulla rubriikilla. Idea on lainattu tutkimuksesta, jossa kielimalleja käytetään arvioijina. Zheng ym. osoittivat MT-Bench-tutkimuksessa, että vahva malli tuomarina on yli 80 prosentissa tapauksista samaa mieltä ihmisten kanssa, mikä on samaa tasoa kuin ihmisten keskinäinen yksimielisyys. Sama tutkimus nimeää myös rajat: sijaintivinouma, pituusvinouma, mallin taipumus suosia omaa tuotostaan ja rajallinen päättelykyky.
Tällä sivustolla portin rubriikki on julkinen. Faktat ja lähteet painavat 40 pistettä, hyöty 25, omaperäisyys 15, kieli 10 ja rakenne 10. Kynnys on 70. Alle kynnyksen jäävä teksti saa yhden korjauskierroksen palautteella, ja jos se jää edelleen alle, se tallennetaan hylättynä ja näytetään taululla syineen. Rubriikin ja sen tutkimustaustan avaan artikkelissa Laatuportti: näin toinen kielimalli arvioi tekoälyn kirjoittaman tekstin.
Portti ei ole totuuskone. Se ei voi tietää, onko luku oikea, ellei lähde ole tekstissä ja ellei luku ole lähteessä. Se karsii ilmeiset puutteet: lähteettömät luvut, tiivistelmän, joka ei vastaa otsikkoon, väliotsikot, jotka ovat aiheen nimiä eivätkä väitteitä. Se ei erota hyvää suomea erinomaisesta eikä huomaa, jos koko aihe on turha. Siksi ihminen on putken viimeinen ja tärkein vaihe.
Ihmisvastuu tarkoittaa nimeä, ei nimimerkkiä
Googlen ohjeet eivät vaadi, että ihminen kirjoittaa. Ne kysyvät, onko lukijalle selvää, kuka sisällöstä vastaa, ja johtaako nimi tietoihin tekijästä. Laatuarvioijien ohjeen mukaan luottamus on E-E-A-T:n tärkein osa, koska epäluotettavalla sivulla on heikko E-E-A-T riippumatta siitä, kuinka kokeneelta tai asiantuntevalta se näyttää. Arvioijien pisteet eivät vaikuta sijoituksiin suoraan, kuten Google How Search works -sivulla toteaa, mutta ne kertovat, mihin suuntaan järjestelmiä säädetään: vuonna 2023 Google teki 719 326 laatutestiä.
Tämän sivuston ratkaisu on yksinkertainen. Jokaisessa artikkelissa lukee, mikä malli sen kirjoitti, milloin, montako hakua se teki, minkä pistemäärän portti antoi ja mitä portti huomautti. Sen alla lukee ihmisen nimi, Ilkka Immonen, ja tarkistuksen tila: odottaa, tarkistettu tai hylätty. Kone kirjoittaa, ihminen vastaa nimellään. Se on suora vastaus Googlen Kuka, miten, miksi -kysymyksiin, eikä siihen tarvita erillistä tekoälymerkintää.
Näin tämän sivuston putki toimii
Tämä sivusto on Astro-pohjainen staattinen sivusto Cloudflare Pagesissa, ja lähdekoodi on GitHub-repossa. Sisältökone on Node-skripti, jonka GitHub Action ajaa joka aamu kello kuusi. Vaiheet ovat nämä:
- Skripti ottaa jonosta seuraavan aiheen. Jono on ihmisen kirjoittama lista otsikoista ja kulmista.
- Kirjoittajamalli (Claude Sonnet 5) saa kirjoitusohjeen ja aiheen. Sillä on käytössään web search -työkalu, enintään kahdeksan hakua per artikkeli, ja sen pitää liittää jokaiseen lukuun URL, jonka se on avannut.
- Laatuportti, erillinen mallikutsu, pisteyttää tekstin rubriikilla 0–100. Alle 70 pistettä johtaa yhteen korjauskierrokseen. Jos toinenkin versio jää alle, artikkeli tallennetaan hylättynä.
- Markdown-tiedosto frontmattereineen kirjoitetaan repoon ja Cloudflare Pages julkaisee sivun.
- Ihminen lukee julkaistun tekstin ja merkitsee sen tarkistetuksi tai hylkää sen. Hylkäykset näkyvät julkisesti taululla.
Kustannus on arvio, koska ensimmäinen automaattiajo ei ole vielä pyörinyt. Claude-alustan hinnastolla Sonnet 5 maksaa 2 dollaria miljoonalta input-tokenilta ja 10 dollaria miljoonalta output-tokenilta, ja web search 10 dollaria tuhannelta haulta. Esimerkkiartikkeli, jossa on 12 000 input-tokenia, 3 000 output-tokenia ja kahdeksan hakua, maksaa noin 13 senttiä ennen porttia ja korjauskierrosta. Laskun ja sen, mikä putkessa voi mennä pieleen, käyn läpi artikkelissa Sisältökone käytännössä: näin tämä sivusto kirjoittaa artikkelin joka aamu.
Launch-erä, johon tämäkin teksti kuuluu, on kirjoitettu 22.9.2026 Claude-agenteilla käsin käynnistettynä, ei vielä automaatiolla. Sama ohje, sama rubriikki, sama ihminen tarkistajana, mutta ajastin ei ole vielä käynyt kertaakaan. Se sanotaan tässä, koska muuten tämä sivu rikkoisi omaa sääntöään.
Pk-yritys voi käyttää tekoälyä sisältöön, kun se pitää kolme asiaa omissa käsissään
Googlen ohjeista seuraa suomalaiselle pk-yritykselle käytännön linja, joka ei vaadi omaa sisältökonetta. Ensimmäinen asia on aihe. Tekoäly kirjoittaa mielellään “10 vinkkiä” -sivun mistä tahansa, ja juuri se sivu on Googlen listalla ensimmäisenä esimerkkinä, koska sama teksti on jo sadalla muulla sivulla. Aihe kannattaa valita niin, että yritys tietää siitä jotain, mitä malli ei tiedä: oma hinnoittelu, oma asiakastapaus, oma mittaus, oma kaupunki.
Toinen asia on faktat. Malli saa tehdä rungon, mutta luvut, nimet ja väitteet tarkistaa ihminen, ja lähde laitetaan tekstiin näkyviin. Jos lähdettä ei ole, luku poistetaan. Tämä on sama sääntö, joka tämän sivuston portissa painaa 40 pistettä sadasta, ja se on sääntö, jonka Googlen tekoälyohje mainitsee ensimmäisenä: tarkkuus, laatu ja relevanssi, myös metatiedoissa.
Kolmas asia on nimi. Sivulla pitää lukea, kuka siitä vastaa, ja nimen pitää johtaa oikeaan henkilöön. Tekoälymerkintää Google ei vaadi, mutta jos sisältö on tehty automaattisesti, sen kertominen on Googlen suositus, eikä sen kertominen ole tämän sivuston kokemuksen mukaan haitannut mitään, koska mitään ei ole vielä mitattu. Se on rehellinen tilanne, ja rehellinen tilanne on parempi lähtökohta kuin lupaus.
Näillä kolmella tekoäly on Googlen sanoin hyödyllinen työkalu tutkimiseen ja jäsentämiseen. Ilman niitä se on nopein tapa tuottaa sivuja, joita kukaan ei lue eikä Google näytä.
Mitä tämä sivusto testaa ja mitä se ei väitä
Googlen sanoin automaatio ei ole ongelma, arvoton massa on. Tämä sivusto testaa, voiko sisältökone tuottaa joka päivä yhden artikkelin, joka läpäisee kolme kysymystä: väitteet ovat tarkistettavia, sivulla on jotain omaa, ja ihminen vastaa siitä nimellään. Mittari on yksinkertainen: löytääkö kukaan tänne Googlen, Bingin, ChatGPT:n, Perplexityn tai AI Moden kautta, ja kuinka moni artikkeli päätyy hylätyksi.
Sivusto ei väitä, että tämä toimii. Se ei väitä, että sisältökone korvaa toimittajan, eikä se väitä, että kuka tahansa voi kopioida putken ja saada liikennettä. Googlen oma määritelmä spämmistä on päätarkoitus, ja päätarkoitus ei ole tekninen ominaisuus, jonka voi asentaa. Se on päätös siitä, mitä sivulle laitetaan ja mitä jätetään pois.
Jos tekoälyteksti saa sata sivua kuukaudessa ilman yhtäkään lähdettä, koetta tai omaa havaintoa, se on Googlen listalla ensimmäisenä esimerkkinä. Jos se saa yhden sivun päivässä, jossa jokainen luku on jäljitettävissä ja ihminen on lukenut sen, se on Googlen ohjeen mukaan tekoälyn hyödyllistä käyttöä. Ero ei ole työkalussa. Ero on siinä, kuka lukee tekstin ennen kuin se lähetetään maailmalle ja mitä hän uskaltaa hylätä.
Kysymyksiä, joita tästä haetaan
Rankaiseeko Google tekoälyllä kirjoitetusta tekstistä?
Ei tekoälyn takia. Googlen ohje sanoo, että tekoäly on hyödyllinen tutkimiseen ja jäsentämiseen, mutta monen sivun tuottaminen ilman lisäarvoa voi rikkoa scaled content abuse -sääntöä. Ratkaisevaa on, mitä sivu antaa lukijalle, ei se, kuka sen kirjoitti.
Pitääkö tekoälysisältö merkitä?
Google ei vaadi merkintää tavallisilla sivuilla, mutta suosittelee kertomaan, miten sisältö tehtiin, jos se on yleisölle mielekästä. Verkkokaupan tuotetiedoissa ja tekoälykuvissa merkintä on Merchant Centerin kautta pakollinen.
Mikä on laatuportti?
Toinen kielimallikutsu, joka arvioi kirjoittajamallin tekstin ennalta julkaistulla rubriikilla ja antaa pisteet 0–100. Tällä sivustolla kynnys on 70 ja korjauskierroksia on yksi. Portti ei korvaa ihmistä, se karsii ilmeiset virheet ennen kuin ihminen lukee tekstin.
Lähteet
- Google Search Central: Spam policies for Google web searchScaled content abuse -määritelmä ja esimerkit sanasta sanaan; päivitetty 28.8.2026
- Google Search Central: Guidance on using generative AI contentTekoäly sallittu tutkimiseen ja jäsentämiseen; tarkkuus, metatiedot, avoimuus; päivitetty 10.12.2025
- Google Search Central: Creating helpful, reliable, people-first contentE-E-A-T ja Kuka, miten, miksi -kysymykset automaation avoimuudesta
- The Keyword (blog.google): New ways we're tackling spammy, low-quality content on SearchMaaliskuun 2024 päivitys: politiikkaa laajennettiin koskemaan ihmistenkin tekemää massatuotantoa; 40 % odotus, 45 % toteuma
- Google Search Central: AI features and your websiteAI Overviews ja AI Mode eivät vaadi erillistä optimointia tai tekoälytiedostoja
- Google: Search Quality Rater Guidelines (PDF, 11.9.2025)Generatiivisen tekoälyn määritelmä, kohta 4.6.6 ja Lowest-taulukon sanamuoto vähäisen vaivan sisällöstä
- Google: How Search works – Rigorous testingLaatuarvioijien pisteet eivät vaikuta suoraan sijoituksiin; 719 326 laatutestiä vuonna 2023
- Zheng ym.: Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena (arXiv 2306.05685)Mallituomari yli 80 % samaa mieltä ihmisten kanssa; sijainti-, pituus- ja itsesuosintavinouma
- Claude Developer Platform: PricingSonnet 5: 2 $/M input, 10 $/M output; web search 10 $/1000 hakua
Löysitkö virheen?
Tämän tekstin kirjoitti kone ja toinen kone tarkisti faktat. Ihminen ei ole lukenut jokaista tekstiä. Jos jokin on väärin, kerro — ilmoitus menee Ilkka Immoselle, korjaus tehdään ja se merkitään tähän tekstiin näkyviin.