Näkemyksiä
    ChatGPT
    Hakunäkyvyys
    AI-näkyvyys

    Näin ChatGPT valitsee lähteensä — ja mitä se tarkoittaa hakunäkyvyydelle

    Avisible Team27. elokuuta 20267 min lukuaika

    Kysymys tulee lähes jokaisessa ensimmäisessä tapaamisessa: miten pääsemme ChatGPT:n vastauksiin? Vastaus on harvinaisen konkreettinen — konkreettisempi kuin useimmat odottavat — mutta se ei ole sama kuin hakukoneoptimoinnissa, ja osa yleisistä neuvoista on suoraan väärin.

    Kaksi eri asiaa: koulutusdata ja haku

    Tekoälyn vastaus voi perustua kahteen eri lähteeseen, ja ne toimivat täysin eri tavalla. Tämän eron ymmärtäminen ratkaisee, mihin kannattaa käyttää aikaa.

    Koulutusdata on se, mitä malli on oppinut ennen käyttöä. Siihen et voi vaikuttaa nopeasti. Se muuttuu, kun malli koulutetaan uudelleen, ja se tapahtuu harvoin ja ennakoimattomasti. Jos brändisi kuvataan väärin koulutusdatan pohjalta, korjaus näkyy vasta seuraavassa mallisukupolvessa.

    Haku on se, mitä malli etsii verkosta juuri sillä hetkellä, kun kysymys esitetään. Tähän voit vaikuttaa, ja muutokset näkyvät päivissä tai viikoissa.

    Käytännön työ kohdistuu lähes aina jälkimmäiseen. Nyrkkisääntö: kun vastauksessa on lähdelinkkejä, kyse on hausta. Kun vastaus on yleisluontoinen eikä siinä ole linkkejä, kyse on todennäköisesti koulutusdatasta.

    Mihin hakemistoon ChatGPT nojaa

    Tämä on se kohta, joka yllättää: ChatGPT:n verkkohaku nojaa merkittäviltä osin Bingin hakemistoon. Se tarkoittaa, että Bing Webmaster Tools on käytännössä lähin asia, joka on olemassa "ChatGPT:lle ilmoittautumiseen".

    Kannattaa huomata, mitä tämä ei tarkoita. Se ei tarkoita, että Bing-sijoitus määrää tekoälyn vastauksen. Malli valitsee ja tiivistää lähteitä omilla perusteillaan, ja hyvin sijoittuva sivu voi jäädä käyttämättä. Mutta jos sivusi ei ole hakemistossa lainkaan, se ei voi päätyä myöskään vastaukseen. Indeksointi on edellytys, ei tae.

    Muut järjestelmät toimivat eri tavoin, ja tämä on syytä sanoa selvästi, koska yhtä temppua ei ole. Claude käyttää verkkohaussaan Brave Searchin rajapintaa. Perplexity ylläpitää omaa indeksointiaan. Googlen AI-vastaukset nojaavat Googlen omaan hakemistoon, jolloin Search Console on oikea työkalu.

    Yhtään näistä ei voi "lähettää" sisältöä samaan tapaan kuin sitemapin hakukoneelle. Ainoa suora kanava on hakemisto, jonka päällä järjestelmä toimii.

    Mitä voit tehdä — ja missä järjestyksessä

    1. Varmista, että sivustosi on hakemistoissa. Sitemap Google Search Consoleen ja Bing Webmaster Toolsiin. Tämä on perusasia, joka on yllättävän usein tekemättä juuri Bingin osalta — moni on hoitanut Googlen vuosia sitten eikä ole koskaan avannut Bingin työkalua.

    2. Salli tekoälyrobotit. Tarkista robots.txt-tiedostosi. GPTBot, OAI-SearchBot, ClaudeBot ja PerplexityBot ovat erillisiä robotteja omilla nimillään, ja moni sivusto estää ne huomaamattaan — joko vanhan säännön takia tai siksi, että joku esti ne aikanaan tarkoituksella eikä päätöstä ole sen jälkeen katsottu uudelleen.

    3. Vastaa kysymykseen sivulla, joka on siitä. Tekoäly tiivistää lähteitä. Sivu, joka vastaa yhteen kysymykseen selkeästi, on helpompi lainata kuin sivu, joka sivuaa kymmentä aihetta. Tämä on usein rakenteellinen muutos, ei kirjoitustyö.

    4. Anna numerot ja ehdot näkyviin. Hinta, toimitusaika, laajuus, rajoitukset, kenelle tuote ei sovi. Tekoäly ei arvaa niitä puolestasi, ja ostaja kysyy juuri niitä. Konkreettinen rajaus on parempi lähde kuin ylistävä yleiskuvaus.

    5. Tee sisällöstä koneluettavaa. Rakenteinen data, selkeät otsikot, yksiselitteinen kieli. Vältä tietoa, joka on olemassa vain kuvassa tai liitteessä.

    Millainen sivu päätyy lähteeksi

    Kun katsoo, mitä sivuja tekoäly tosiasiassa lainaa, ne muistuttavat toisiaan yllättävän paljon. Yhteisiä piirteitä on neljä.

    Sivu käsittelee yhtä kysymystä. Otsikko on kysymys tai väite, ja koko sivu vastaa siihen. Yleissivu, joka esittelee koko tarjooman, on huono lähde mihinkään yksittäiseen kysymykseen.

    Vastaus on heti alussa. Ei johdantoa toimialan murroksesta. Ensimmäinen kappale sisältää sen, mitä kysyttiin, ja loppu perustelee sen.

    Mukana on jotain tarkistettavaa. Luku, hinta, aikaväli, määrä, rajaus. Tekoäly nojaa mieluummin lähteeseen, joka sanoo "kolme työpäivää", kuin lähteeseen, joka sanoo "nopeasti".

    Kieli on yksiselitteistä. Sisäinen termistö, tuotenimet ilman selitystä ja markkinointifraasit tekevät sivusta vaikean käyttää. Jos ihmisen pitää tietää konteksti ymmärtääkseen lauseen, malli ei sitä lainaa.

    Huomionarvoista on, mitä listalta puuttuu: pituus, avainsanatiheys ja julkaisutiheys. Ne eivät ratkaise sitä, päätyykö sivu vastaukseen.

    Mikä ei toimi

    Avainsanojen toistaminen ei auta. Tekoäly ei laske esiintymiä vaan muodostaa merkityksen. Sivu, joka toistaa termiä kaksikymmentä kertaa, ei ole parempi lähde kuin sivu, joka selittää asian kerran kunnolla — ja lukijalle se on huonompi.

    Myöskään tekoälyn suostuttelu ei toimi. Sivulle piilotettu ohje siitä, miten brändi pitäisi kuvata, ei ohjaa mallia. Jos se huomataan, se on maineriski, ja se huomataan yhä useammin.

    Sisällön massatuotanto ei myöskään auta. Sata ohutta sivua ei korvaa yhtä sivua, jolla on jotain sanottavaa. Tekoäly valitsee lähteen sen perusteella, vastaako se kysymykseen, ei sen perusteella, kuinka monta sivua sivustolla on.

    Ja yksi tarkennus, joka kannattaa sanoa ääneen: llms.txt on ehdotettu käytäntö, ei standardi, jonka noudattamiseen mikään suuri tekoälytoimittaja olisi julkisesti sitoutunut. Sen tekeminen ei maksa juuri mitään ja se voi auttaa, mutta se ei ole ilmoittautumiskanava eikä sitä kannata myydä sellaisena.

    Miten tiedät, toimiiko se

    Ainoa luotettava tapa on mitata: esitä samat kysymykset uudelleen ja katso, muuttuiko maininta. Yksittäinen vastaus ei kerro mitään, koska tekoäly vastaa hieman eri tavalla joka kerta — sama kysymys voi tuottaa maininnan kerran ja jättää sen pois seuraavalla.

    Tämä on syy, miksi mittaamme jokaisen kysymyksen useaan kertaan ja useassa järjestelmässä. Ilman toistoa et tiedä, korjasitko ongelman vai osuitko sattumalta hyvään vastaukseen.

    Aikajänne kannattaa asettaa realistisesti. Indeksointiin liittyvät korjaukset näkyvät nopeimmin, päivissä tai parissa viikossa. Sisältömuutokset vaativat, että sivu ensin löydetään ja sitten valitaan lähteeksi — siihen menee tyypillisesti viikkoja. Koulutusdataan liittyvät kuvausvirheet eivät korjaannu tällä aikajänteellä lainkaan.

    Yhteenveto

    ChatGPT:n hakunäkyvyys syntyy kolmesta asiasta: sivusi on hakemistossa, robotit pääsevät sinne, ja sivulla on kysymykseen konkreettinen vastaus. Järjestys on tuo, koska kaksi ensimmäistä ovat edellytyksiä kolmannelle.

    Mikään näistä ei ole temppu. Ne ovat perustyötä, joka on monella tekemättä nimenomaan siltä osin, mikä koskee muita kuin Googlea.