Mitä ihmiset kysyvät tekoälyltä? 10 000 aidon keskustelun analyysi
Yhdysvaltalaisten suurten tekoälyyritysten tutkimukset ovat jo osoittaneet, mihin ihmiset käyttävät chatbotteja englanniksi. 22 kielen Eurooppa on kuitenkin eri tarina — ja voimme kertoa sen omasta datastamme. AI chatimme rinnalla tarjoamme 22 kielellä myös ilmaista Chat GPT -vaihtoehtoa — ja juuri siitä luokittelimme 10 000 keskustelua 15 aihepiiriin ja selvitimme, mitä eurooppalaiset todella haluavat tekoälyltä. Spoilerina: paljon enemmän työsähköposteja kuin filosofisia väittelyitä.
Yksityisyydestä heti alkuun: käytimme yksinomaan koostettua, anonymisoitua dataa — ilman IP-osoitteita ja ilman minkään yksittäisen keskustelun sisällön julkaisemista (kaikki artikkelin esimerkit ovat parafraaseja). Maksavien asiakkaiden data ei koskaan päädy tutkimuksiimme. Tarkemmat tiedot artikkelin lopussa olevassa metodologiassa.
Keskeiset havainnot lyhyesti
Kolmasosa kaikista keskusteluista (33 %) on tekstin parissa työskentelyä — kirjoittamista, korjaamista, kääntämistä. Yleisin yksittäinen tehtävä: työsähköposti tai virallinen hakemus.
Luova kirjoittaminen ja roolipeli muodostavat 22 % ranskalaisista keskusteluista — viisi kertaa enemmän kuin Euroopan keskiarvo. Ranskalaiset ovat tehneet tekoälystä näyttämön.
Liettualaiset ja virolaiset kysyvät tekoälyltä terveydestä eniten Euroopassa — joka seitsemäs keskustelu. Lääkkeet, laboratoriotulokset, oireet.
Eksplisiittinen sisältö muodostaa tiukan auditoinnin jälkeen 2,2 % keskusteluista. Data ei vahvista mainetta, jonka mukaan AI chatit olisivat eroottisia leluja.
Kokonaiskuva: sähköpostit, tekstien korjaukset ja kotitehtävät
Voittaja on selvä: työhön tai virastoon liittyvän tekstin kirjoittaminen — sähköposti esimiehelle, valitus toimittajalle, hakemus virastoon, ansioluettelo. Kuudesosa kaikista keskusteluista. Kun lisätään omien tekstien oikoluku (11,6 %), henkilökohtaiset viestit ja onnittelut (3,0 %) sekä käännökset (2,2 %), saamme tutkimuksen pääväitteen:
Kolmasosa kaikista tekoälykeskusteluista (33,1 %) on tekstin parissa työskentelyä. Enemmän kuin yleistieto, koulu ja käytännön ohjeet yhteensä. Tekoäly Euroopassa ei ole oraakkeli eikä kaveri — se on toimistoavustaja. Tämä sopii kauniisti yhteen aikatutkimuksemme kanssa: liikenteen huippu on tiistaina kello 11 aamupäivällä, ja viikonloppuisin liikenne putoaa puoleen.
Ääripäässä ovat portugalilaiset ja hollantilaiset: kolmasosa heidän keskusteluistaan on puhdasta oikolukua — “tässä on tekstini, korjaa se” (32,7 % ja 28,6 % pelkkää oikolukua). Virolaiset ja kreikkalaiset taas eivät juuri työskentele tekstin parissa — heille tekoäly on enemmän hakukone ja neuvonantaja.
Maakohtaiset profiilit: mitä kukin maa tekee toisin
Kokonaisluvut peittävät kaikkein kiinnostavimman asian — jokainen markkina-alue käyttää tekoälyä omalla tavallaan. Tässä ovat aiheet, joissa yksittäiset kielet poikkeavat eniten; suluissa oleva luku kertoo, kuinka moninkertaisesti useammin aihe esiintyy verrattuna Euroopan keskiarvoon:
| Kieli | Mitä käsitellään selvästi useammin kuin muualla Euroopassa |
|---|---|
| Saksa | yleistieto (2,6-kertaisesti) — joka neljäs keskustelu on faktakysymys |
| Ranska | luova kirjoittaminen ja roolipeli (5,5-kertaisesti) |
| Englanti | koulu ja opiskelu (2,1-kertaisesti) |
| Espanja | kuvien generointi (2,3-kertaisesti), henkilökohtaiset viestit (2,0-kertaisesti) |
| Tšekki | oikeus ja byrokratia (1,9-kertaisesti) |
| Slovakki | oikeus ja byrokratia (1,7-kertaisesti), terveys (1,7-kertaisesti) |
| Liettua | terveys (2,5-kertaisesti), käytännön ohjeet (2,3-kertaisesti) |
| Viro | käytännön ohjeet (2,9-kertaisesti), terveys (2,4-kertaisesti) |
| Unkari | terveys (2,1-kertaisesti), tuotteiden ja palveluiden haku (2,0-kertaisesti) |
| Bulgaria | terveys (1,9-kertaisesti), oikeus ja byrokratia (1,7-kertaisesti) |
| Kreikka | oikeus ja byrokratia (2,7-kertaisesti) |
| Sloveeni | oikeus ja byrokratia (3,0-kertaisesti), käytännön ohjeet (2,8-kertaisesti) |
| Puola | henkilökohtaiset viestit (1,9-kertaisesti), kuvien generointi (1,8-kertaisesti) |
| Hollanti | tekstin oikoluku (2,5-kertaisesti) |
| Portugali | tekstin oikoluku (2,8-kertaisesti) |
| Italia | tekstin oikoluku (1,7-kertaisesti), työhön ja virastoihin liittyvä kirjoittaminen (1,5-kertaisesti) |
| Ruotsi | henkilökohtaiset viestit (3,3-kertaisesti) |
| Kroatia | tuotteiden ja palveluiden haku (2,2-kertaisesti), terveys (2,2-kertaisesti) |
Muutama profiili ansaitsee erityismaininnan:
Saksalaiset käyttävät tekoälyä tietosanakirjana. Yleistieto ja mielenkiintoiset faktat muodostavat 25,5 % saksalaisista keskusteluista — 2,6-kertaisesti keskiarvoon nähden ja eniten kaikista kielistä. Yhdessä aikatutkimuksen havainnon kanssa (79,6 % saksalaisista keskusteluista on yksi ainoa pitkä viesti) syntyy johdonmukainen kuva: tarkka kysymys, tarkka vastaus, loppu.
Englanti on kotitehtävien kieli. Koulu ja opiskelu muodostavat 18,6 % englanninkielisistä keskusteluista — kaksinkertaisesti keskiarvoon nähden. Englanninkieliseen versioon virtaa globaali opiskelijayleisö: esseet, koekysymykset, oppisisällön selitykset.
Terveys: Baltian ja Balkanin osa-alue
Liettualaiset kysyvät tekoälyltä terveydestä eniten Euroopassa — joka seitsemäs keskustelu. Kyse ei ole yleisistä ohjeista: tyypillinen kysymys on omien laboratoriotulosten tai tietyn lääkkeen sivuvaikutusten tulkinta. Koko Baltia ja Balkan käsittelevät terveysasioita tekoälyn kanssa kaksi–kaksi ja puoli kertaa useammin kuin Länsi-Eurooppa — kaava, joka voi kertoa yhtä lailla lääkäreiden saatavuudesta kuin luottamuksesta teknologiaan. Ranskalaiset ja puolalaiset eivät juuri käsittele terveysasioita tekoälyn kanssa.
Byrokratia: tekoäly virkailijana Keski- ja Etelä-Euroopalle
Irtisanomisajat, korvausvaatimukset, etuudet, perinnöt. Sloveenit ja kreikkalaiset kysyvät tekoälyltä oikeudellisista ja virallisista asioista 15–17 %:ssa keskusteluista — ja korkealla on myös tšekki (10,5 %, 4. sija) ja slovakki. Vastakkaisessa päässä ovat englanti ja hollanti (alle 2 %). Siellä missä byrokratia on monimutkaista ja oikeusapu kallista, ihmiset kysyvät koneelta.
Ranskalainen ilmiö: tekoäly näyttämönä
Tämä on koko tutkimuksen selkein poikkeama: luova kirjoittaminen ja roolipeli muodostavat 21,8 % ranskalaisista keskusteluista — 5,5-kertaisesti Euroopan keskiarvoon nähden ja enemmän kuin työhön liittyvä kirjoittaminen. Ranskalaiset käyttäjät (sisällön perusteella usein nuoria animefaneja) antavat tekoälyn näytellä suosikkihahmojaan ja käyvät niiden kanssa pitkiä dialogeja — heille tekoäly ei ole työkalu vaan näyttämö. Sama ilmiö nousi esiin jo itsenäisesti kohteliaisuustutkimuksessamme, jossa ranskalainen roolipeli vaikeutti sen mittaamista, kuinka ihmiset kohtelevat tekoälyä kuin ihmistä. Muissa kielissä luova kirjoittaminen pysyy noin 1–5 %:n tasolla.
Bonus: seksuaalinen sisältö on harvinaisempaa kuin maine antaa ymmärtää
Tekoälychateilla on maine eroottisen roolipelin työkaluina. Data kertoo jotain muuta: tiukan auditoinnin jälkeen (ks. metodologia) eksplisiittinen seksuaalinen sisältö muodostaa 2,2 % kaikista keskusteluista. Kärjessä on jälleen ranska (11,0 %) ennen puolaa (7,9 %) — ranskan kohdalla kyse on saman roolipeli-ilmiön eksplisiittisestä haarasta. Kuudessa kielessä emme löytäneet sitä lainkaan, ja tšekki on 0,6 %:lla juuri nollan yläpuolella. Pidä lukua tavallisen, moderoidun chatin käyttäytymisen alarajana — erikoistuneilla “AI companion” -palveluilla luvut olisivat toisenlaiset.
Ja vielä yksi kertova kategoria: 5,5 % ihmisistä vain testaa tekoälyä — tervehdys ilman jatkoa, “mikä on 2 + 2”, “osaatko suomea?”. Kohteliaisuustutkimuksen riippumaton sanastopohjainen mittaus päätyi samaan lukuun (5,4 %), mikä ilahduttaa meitä metodisesti: kaksi eri menetelmää, sama tulos.
Näin mittasimme tämän
- Otos: 10 000 anonymisoitua tallennetta GuideGlaren ilmaisesta Chat GPT -vaihtoehdosta (versio ilman rekisteröitymistä), 23.6.–24.7.2026, 22 kieliversiota; kuuden teknisen duplikaatin poistamisen jälkeen käytämme 9 994 keskustelua — sama otos kuin etiketti- ja aikatutkimuksissamme. Luokittelu kattoi kaikki 9 994 keskustelua. Vertailuihin otetaan mukaan kielet, joissa on vähintään 50 keskustelua (tanska ja suomi jäivät pois). Otoskoot vaihtelevat 53 keskustelusta (sloveeni) 2 775 keskusteluun (englanti); täydelliset kielikohtaiset määrät löydät ladattavasta datasta.
- Taksonomia: 15 asiapitoista kategoriaa sekä tekoälyn testaus, “muut” ja “luokittelemattomat” laadimme empiirisesti — koodaamalla käsin 629 keskustelun kerrostetun otoksen, määritelmineen ja rajatapausten sääntöineen (esim. “käännä minulle terveyttä koskeva teksti” on käännös, ei terveys; pyyntö kirjoittaa valmis virallinen kirje on kirjoittamista, kysymys pykälästä on oikeus).
- Luokittelu: kielimalli luokitteli jokaisen keskustelun täsmälleen yhteen kategoriaan hallitsevan tarkoituksen mukaan (käyttäjän viestien perusteella). Mittasimme laatua sokkoverifioinnilla: vahvempi malli luokitteli itsenäisesti uudelleen 300 satunnaista keskustelua tuntematta alkuperäistä luokkaa — yhteneväisyys 81,7 %, ja erimielisyydet sijoittuvat lähes yksinomaan vierekkäisten kategorioiden välille (tyypillisesti “kirjoita uusi teksti” vs. “korjaa tekstini”). Tämä ei vaikuta suurten kategorioiden järjestykseen; noin 2 prosenttiyksikön eroja vierekkäisten sijojen välillä emme tulkitse.
- Herkän kategorian auditointi: kaikki 336 seksuaaliseksi sisällöksi merkittyä keskustelua kävivät läpi lisäarvioinnin vahvemmalla mallilla. Läpäisi 66 % — loput olivat pääosin romanttista roolipeliä ilman eksplisiittistä sisältöä, ja siirsimme ne luovaan kirjoittamiseen. Julkaistut luvut ovat siis korjauksen jälkeisiä; ennen sitä kategoria olisi ollut 3,4 %.
- Tilastot: prosenttiluvut ovat osuuksia kunkin kielen sisällä; kaikille arvoille laskemme Wilsonin 95 %:n luottamusvälit (kokonaisuudessaan ladattavassa datassa). Luku “kuinka moninkertaisesti useammin kuin keskiarvo” on kategorian osuuden suhde kielessä verrattuna koko otoksen osuuteen; kommentoimme vain poikkeamia ≥1,5x riittävän suurilla otoksilla.
- Yksityisyys: käytimme yksinomaan koostettua dataa — ilman IP-osoitteita, ilman käyttäjien tunnistamista, ilman keskustelujen sisällön julkaisemista; kaikki artikkelin ja taksonomian määritelmien esimerkit ovat parafraaseja.
- Rajoitukset: yksi kategoria per keskustelu (moniaiheiset keskustelut saavat hallitsevan aiheen); luokittelu perustuu lyhyeen otteeseen keskustelusta; 3,1 % keskusteluista jäi luokittelemattomiksi (katkelmia, epäjohdonmukaista tekstiä), ja jätämme ne perusjoukkoon. Kieli ei ole sama asia kuin maa — erityisesti espanjan, portugalin ja englannin kohdalla merkittävä osa käyttäjistä kirjoittaa muilta mantereilta. Otos koostuu yhden ilmaistyökalun käyttäjistä; luvut kuvaavat käyttäytymistä meidän chatissamme, eivät kokonaisen maan väestöä.
- Ladattava data ja lähdeviite: koko koostettu data (18 kategoriaa × 22 kieltä × luottamusvälit) voit ladata CSV-muodossa. Voit vapaasti käyttää lukuja ja kaavioita artikkeleissa, blogeissa ja esityksissä — riittää, että mainitset “Lähde: GuideGlare” aktiivisella linkillä tälle sivulle; tarkemmin viittausohjeissa. Toimitamme mielellämme kaaviot painolaatuisina — kirjoita osoitteeseen info@explicaire.com.
Kokeile itse
Tämän tutkimuksen data on peräisin ilmaisesta Chat GPT -vaihtoehdostamme — se toimii kaikilla tämän tutkimuksen 22 kielellä, ilman rekisteröitymistä, ja täyden version löydät nimellä GuideGlaren AI chat. Kirjoititpa sitten sähköpostin pomollesi kuten kuudesosa Euroopasta, tai haluat jutella suosikkihahmosi kanssa kuten ranskalaiset. Ja jos sinua kiinnostaa, milloin kaikki ehtivät tehdä tämän, lue jatkotutkimus Milloin puhumme tekoälylle.
Kokeile GuideGlarea ilmaiseksi
AI chat, kuvat ja ääni samassa tilissä — kaikilla tämän tutkimuksen 22 kielellä. Rekisteröityminen vie minuutin.