mainostoimisto.ai
Oulu · 06:00:00

5 minAutomaattinen sisältöKirjoitti kone · faktat tarkisti kone · vastuu: Ilkka Immonen

Scaled content abuse: mitä Google oikeasti kieltää tekoälysisällössä

Vastaus lyhyestiGoogle kieltää sivujen tuottamisen suurina määrinä, kun päätarkoitus on hakusijoitusten manipulointi eikä käyttäjän auttaminen, riippumatta siitä, tekeekö sen kone vai ihminen. Tekoäly mainitaan esimerkkinä välineestä, ei kiellon syynä. Sääntö laajennettiin maaliskuussa 2024 koskemaan myös ihmisten tekemää massatuotantoa. Raja kulkee lisäarvossa: tarkistettavat väitteet, jotain omaa ja nimetty vastuuhenkilö.

Moni suomalainen yrittäjä on kuullut, että Google rankaisee tekoälytekstistä. Googlen spämmisäännöissä ei lue niin. Tässä on sääntö sellaisena kuin se on kirjoitettu, suomennettuna lause lauseelta, ja sen jälkeen se, mitä siitä seuraa sivustolle, jonka tekstit kone kirjoittaa.

Sääntö sanasta sanaan: päätarkoitus ratkaisee, ei väline

Googlen spämmisäännöissä (päivitetty 28.8.2026) scaled content abuse määritellään näin:

“Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users. This abusive practice is typically focused on creating large amounts of unoriginal content that provides little to no value to users, no matter how it’s created.”

Suomeksi: skaalattu sisällön väärinkäyttö on sitä, että tuotetaan monta sivua, joiden päätarkoitus on hakusijoitusten manipulointi eikä käyttäjien auttaminen. Tyypillisesti kyse on suuresta määrästä epäomaperäistä sisältöä, joka antaa käyttäjälle vähän tai ei mitään arvoa, riippumatta siitä, miten se on tehty.

Kolme sanaa kantaa koko määritelmän. Many pages, monta sivua: yksi teksti ei ole skaalattua mitään. Primary purpose, päätarkoitus: Google arvioi, mitä varten sivut ovat olemassa. No matter how it’s created, riippumatta tekotavasta: kone tai ihminen, sama sääntö.

Sen jälkeen Google listaa esimerkkejä, jotka eivät ole tyhjentäviä. Ensimmäinen kuuluu: “Using generative AI tools or other similar tools to generate many pages without adding value for users”, eli generatiivisten tekoälytyökalujen tai vastaavien käyttö monen sivun tuottamiseen lisäämättä arvoa käyttäjille. Ehto on lopussa: ilman lisäarvoa. Tekoäly ei ole esimerkissä ongelma, vaan tyhjät sivut ovat.

Muut neljä esimerkkiä ovat: syötteiden, hakutulosten tai muun sisällön kaapiminen sivuiksi, myös automaattisesti muunnettuna esimerkiksi synonymisoimalla tai kääntämällä, kun arvoa on vähän; sisällön yhdistely eri sivuilta lisäämättä arvoa; useiden sivustojen luominen, jotta sisällön massaluonne piiloutuisi; ja sivut, joiden sisällössä on hakusanoja mutta ei juuri järkeä lukijalle. Kääntämisen maininta kannattaa panna merkille Suomessa: englanninkielisen sivuston ajaminen konekääntäjän läpi sadaksi suomenkieliseksi sivuksi ilman muuta työtä on listalla nimeltä.

Maaliskuussa 2024 sääntö laajeni koskemaan myös ihmisiä

Sääntö ei ole aina ollut tässä muodossa. Googlen The Keyword -blogi kertoi maaliskuussa 2024, että aiempi sääntö oli “originally designed to address instances of content being generated at scale where it was clear that automation was involved”, eli suunniteltu tapauksiin, joissa automaation osuus oli ilmeinen. Uusi muotoilu keskittyy Googlen sanoin itse toimintaan: “producing content at scale to boost search ranking — whether automation, humans or a combination are involved”.

Tämä on koko asian ydin. Vuoteen 2024 asti sääntö oli käytännössä “automaattisesti tuotettu sisältö on spämmiä”. Kielimallien yleistyttyä tuo muotoilu ei enää toiminut, koska kone kirjoittaa sujuvaa tekstiä eikä automaatiota voi tunnistaa pinnasta. Google siirsi rajan tekotavasta tarkoitukseen ja lisäarvoon. Samalla kirjoituksella Google otti käyttöön kaksi muuta uutta sääntöä: vanhentuneiden verkkotunnusten väärinkäytön ja sivuston maineen väärinkäytön, jossa arvoton kolmannen osapuolen sisältö julkaistaan maineikkaalla sivustolla sijoitusten vuoksi.

Google arvioi tuolloin, että päivitys yhdessä aiempien toimien kanssa vähentää heikkolaatuista ja epäomaperäistä sisältöä hakutuloksissa 40 prosenttia. Huhtikuun 26. päivänä 2024 lisätyssä päivityksessä Google kertoi luvun olleen 45 prosenttia. Kumpikin on Googlen oma arvio omasta hakukoneestaan, eikä Google ole julkaissut menetelmää, jolla se laskettiin. Riippumatonta vahvistusta luvulle en löytänyt.

Google sanoo erikseen, että tekoäly saa tutkia ja jäsentää

Spämmisääntöä täydentää erillinen ohje, Guidance on using generative AI content, päivitetty 10.12.2025. Sen ensimmäinen sisällöllinen lause on: “Generative AI can be particularly useful when researching a topic, and to add structure to original content.” Sitä seuraa varoitus: tekoälyn käyttö monen sivun tuottamiseen ilman lisäarvoa voi rikkoa scaled content abuse -sääntöä.

Ohje lisää kaksi asiaa, joita spämmisäännössä ei ole. Tarkkuutta vaaditaan myös metatiedoissa: title-elementeissä, meta descriptioneissa, rakenteisessa datassa ja alt-teksteissä. Ja avoimuutta suositellaan: jos sisältöä tuotetaan automaattisesti, kannattaa harkita tiedon lisäämistä siitä, miten se tehtiin. Suositus, ei vaatimus.

Tekoälyhaun puolella ei ole omaa sääntöä. Googlen AI features and your website -sivu sanoo, että AI Overviews ja AI Mode voivat käyttää query fan-out -tekniikkaa, jossa yksi kysymys hajotetaan useaksi alihauksi. Siitä on syntynyt neuvo tehdä sivu jokaiselle mahdolliselle alihaulle. Samalla sivulla Google toteaa, ettei tekoälyominaisuuksiin ole lisävaatimuksia eikä erillisiä optimointeja, ja spämmisäännön ensimmäinen esimerkki koskee juuri monen sivun tuottamista ilman lisäarvoa. Sivu per alihaku on mekaanisesti sama asia kuin sivu per hakusana, ja se täyttää määritelmän “monta sivua ilman lisäarvoa” riippumatta siitä, millä nimellä tekniikkaa myydään. Pilarissa Automaattinen sisällöntuotanto on koottu, miten sääntö, tekoälyohje ja laatuarvioijien käsikirja sopivat yhteen.

Näin tämä sivusto pysyy rajan oikealla puolella

Tämän sivuston tekstit kirjoittaa kone, ja tarkoitus on julkaista yksi artikkeli päivässä. Se on määritelmän kannalta many pages, joten kysymys ei ole, käytetäänkö tekoälyä, vaan onko sivuilla lisäarvoa ja mikä on niiden päätarkoitus. Sivusto vastaa neljällä säännöllä, jotka ovat kaikki julkisia.

Jokainen luku, tutkimus ja Googlen linjaus saa tekstiin lähteen, jonka kirjoittajamalli on avannut, ja lähde listataan artikkelin lopussa. Jos lähdettä ei löydy, väite jää pois tai sanotaan epävarmaksi. Tämä on suora vastaus Googlen ensimmäiseen vaatimukseen, tarkkuuteen, ja se on samalla ainoa asia, josta artikkeli hylätään automaattisesti.

Toinen kielimalli arvioi tekstin ennen julkaisua rubriikilla, jossa faktat painavat 40 pistettä sadasta ja omaperäisyys 15. Kynnys on 70. Portin rubriikki on julkinen, ja sitä käsittelee oma artikkeli, Laatuportti: näin toinen kielimalli arvioi tekoälyn kirjoittaman tekstin. Portti ei ratkaise päätarkoituksen kysymystä, mutta se karsii ne tekstit, jotka olisivat Googlen esimerkkilistan ensimmäinen kohta: sujuvaa ja tyhjää.

Ihminen, Ilkka Immonen, lukee jokaisen julkaistun tekstin ja merkitsee sen tarkistetuksi tai hylkää sen. Hänen nimensä on sivulla, ja nimi johtaa tietoihin hänestä. Kone kirjoittaa, ihminen vastaa, ja jokaisessa artikkelissa lukee, kumpi teki mitä.

Hylkäykset ovat julkisia. Jos artikkeli jää portissa alle kynnyksen tai ihminen hylkää sen, se ei katoa vaan näkyy sivuston taululla hylättynä syineen. Tämä on kokeen mittari: jos hylkäyksiä on paljon, putki ei toimi, ja sekin kerrotaan.

Yksi asia pitää sanoa suoraan. Tämä teksti ja muu launch-erä on kirjoitettu 22.9.2026 Claude-agenteilla, käsin käynnistettynä, ei vielä aamuisin ajettavalla automaatiolla. Sääntöjen noudattamisesta on siis toistaiseksi vain suunnitelma, ei mittaustulosta. Ensimmäinen automaattiajo kertoo, kuinka moni artikkeli päätyy taululle hylättynä.

Googlen sääntö ei kysy, kuka kirjoitti. Se kysyy, miksi sivu on olemassa. Sivusto, joka julkaisee päivässä yhden lähteistetyn ja ihmisen lukeman tekstin, on Googlen oman ohjeen sanoin tekoälyn hyödyllistä käyttöä. Sivusto, joka julkaisee päivässä sata lähteetöntä tekstiä, on spämmisäännön ensimmäinen esimerkki. Ero ei näy työkalussa vaan sivuilla.

Kysymyksiä, joita tästä haetaan

Onko tekoälyllä kirjoitettu blogiteksti scaled content abusea?

Ei sellaisenaan. Sääntö koskee monen sivun tuottamista ilman lisäarvoa, päätarkoituksena hakusijoitukset. Yksi hyödyllinen ja tarkistettu teksti ei täytä määritelmää, vaikka mallin osuus olisi suuri.

Koskeeko sääntö myös käsin kirjoitettua sisältöä?

Koskee. Google sanoi maaliskuussa 2024 laajentavansa sääntöä koskemaan massatuotantoa riippumatta siitä, ovatko tekijänä automaatio, ihmiset vai molemmat.

Lähteet

  1. Google Search Central: Spam policies for Google web searchScaled content abuse -kohdan koko teksti ja viisi esimerkkiä; päivitetty 28.8.2026
  2. The Keyword (blog.google): New ways we're tackling spammy, low-quality content on SearchMaaliskuun 2024 laajennus, 40 % arvio, 45 % toteuma 26.4.2024
  3. Google Search Central: Guidance on using generative AI contentTekoäly sallittu tutkimiseen ja jäsentämiseen; metatietojen tarkkuus; avoimuus
  4. Google Search Central: AI features and your websiteQuery fan-out -tekniikka ja se, ettei tekoälyhakuun ole erillisiä vaatimuksia

Löysitkö virheen?

Tämän tekstin kirjoitti kone ja toinen kone tarkisti faktat. Ihminen ei ole lukenut jokaista tekstiä. Jos jokin on väärin, kerro — ilmoitus menee Ilkka Immoselle, korjaus tehdään ja se merkitään tähän tekstiin näkyviin.

Sama menetelmä on myytävänä.

Jos löysit tänne hakukoneen tai tekoälyn kautta, näit jo tuloksen. Cosmic Thing tekee saman sinun yrityksellesi: verkkosivut, joista näet vaihtoehdot ennen buildia, ja sisältökoneen, joka tarkistaa omat faktansa ja kertoo sen lukijalle.

Pyydä tarjousKuka tämän takana on