Tutkimus

Tekoäly on mukana lähes jokaisessa lääketieteen tutkimuksessa

Sanavalinnat paljastavat kielimallin, mutta eivät sen roolia

Hanna HuulivuoHanna Huulivuo
Jaa:
Tekoäly on mukana lähes jokaisessa lääketieteen tutkimuksessa
Kuva: Julia Koblitz / Unsplash

Tübingenin yliopistossa Saksassa kolme tutkijaa päätti laskea sanoja. Lena Holzwarth, Rita González-Márquez ja Dmitry Kobak kävivät läpi yli 1,19 miljoonaa englanninkielistä biolääketieteen tutkimusartikkelia vuosilta 2017–2025. Niistä etsittiin sanoja, joita kielimallit suosivat mutta joita ihmiset käyttivät harvoin ennen ChatGPT:tä.

Tulos hätkähdyttää. Joulukuussa 2025 julkaistuista artikkeleista 89 prosentissa oli merkkejä siitä, että tekstin kirjoittamisessa tai muokkaamisessa oli käytetty kielimallia. Koko vuoden 2025 osuus oli 77 prosenttia.

Tiedelehti Nature uutisoi tutkimuksesta elokuussa ja pyöristi luvun 90 prosenttiin. Naturen mukaan arvio on selvästi korkeampi kuin aiemmat arviot kielimallien käytöstä. Lehti on aiemmin kertonut tutkimuksesta, jossa tekoälytekstin merkkejä löytyi noin 14 prosentista biolääketieteen artikkelien tiivistelmistä.

Mitä tutkimus oikeastaan mittasi

Aineisto on peräisin PubMed Centralista, joka on Yhdysvaltain kansallisen lääketieteellisen kirjaston ylläpitämä avoin artikkeliarkisto. Mukaan otettiin vain artikkelit, joissa on alan tavallinen rakenne: johdanto, menetelmät, tulokset ja pohdinta.

Tutkijat eivät ajaneet tekstejä tekoälyntunnistimen läpi. He vertasivat tiettyjen merkkisanojen yleisyyttä siihen, millainen se olisi ollut, jos vuosien 2018–2022 kehitys olisi jatkunut ennallaan. Ylimääräisen osuuden he tulkitsivat kielimallien vaikutukseksi.

Tällainen menetelmä antaa arvion koko aineistosta, mutta yksittäisestä artikkelista se ei kerro mitään. Merkki voi syntyä jo siitä, että tutkija on pyytänyt kielimallia hiomaan englantiaan yhdessä kappaleessa. Tekoälyn apu ei siis tarkoita, että tekoäly olisi kirjoittanut artikkelin tai että artikkelissa olisi virheitä.

Osioiden välillä on selviä eroja. Kun tutkijat vertasivat keskenään yhtä pitkiä tekstinpätkiä, pohdintaosiossa kielimallin jälkiä oli 68 prosentissa ja menetelmäosiossa 32 prosentissa. Pohdinnassa tutkija tulkitsee tuloksiaan ja kertoo, mitä ne merkitsevät.

Tutkimus lukuina

Aineisto: 1 194 287 englanninkielistä avoimesti saatavilla olevaa artikkelia PubMed Centralista vuosilta 2017–2025. Joulukuussa 2025 kielimallin merkkejä oli 89 prosentissa artikkeleista, koko vuonna 2025 77 prosentissa. Kyse on arXiv-palvelussa julkaistusta preprintistä, jota ei ole vielä vertaisarvioitu.

Kieliapu vai oikotie?

Suuri osa maailman tutkijoista kirjoittaa englantia vieraana kielenä. Heille kielimalli on halpa ja nopea kielentarkastaja, ja tutkimuksen tekijätkin toteavat, että tekoäly voi madaltaa kielimuuria.

Huoli liittyy siihen, mitä kaikkea helppo tekstintuotanto tekee mahdolliseksi. Kirjoittajat muistuttavat, että sama tekniikka helpottaa myös vilppiä ja huijausta. Kun käsikirjoituksia syntyy entistä nopeammin, vertaisarviointi kuormittuu aiempaakin enemmän.

“Kaikki nämä kehityskulut voivat heikentää yhteiskunnan luottamusta tieteen prosessiin kokonaisuutena.”

— Lena Holzwarth, Rita González-Márquez ja Dmitry Kobak, Tutkimuksen kirjoittajat, arXiv-preprint (käännetty englannista)

Tavalliselle ihmiselle asia ei ole niin kaukainen kuin voisi luulla. Lääkärien hoitosuositukset, lääkeviranomaisten päätökset ja lehtien terveysuutiset nojaavat viime kädessä juuri tällaisiin artikkeleihin. Vertaisarvioija on usein ainoa ulkopuolinen, joka lukee tutkimuksen huolellisesti ennen julkaisua, ja hän tekee työn yleensä palkatta oman työnsä ohessa.

Sujuva teksti näyttää uskottavalta. Jos kielimalli on muotoillut pohdintaosion, arvioijan pitää pystyä erottamaan, ovatko varovaisetkin johtopäätökset tutkijan omia vai vain hyvin kirjoitettuja.

Lukuun kannattaa silti suhtautua varauksella. Menetelmä olettaa, että ihmisten kirjoitustapa olisi jatkanut muuttumistaan samaa tahtia kuin ennen ChatGPT:tä, ja tekijät myöntävät oletuksen heikkenevän sitä mukaa kuin vuodesta 2022 etäännytään. Ihmiset voivat myös omaksua kielimallien sanastoa, kun he lukevat niiden tuottamaa tekstiä. Tekijöiden arvion mukaan suora kielimallin käyttö selittää silti valtaosan muutoksesta.

Suomessa vastuu on tutkijalla

Tutkimuseettinen neuvottelukunta TENK julkaisi kesäkuussa 2026 kansallisen suosituksen tekoälyn käytöstä tutkimuksessa. TENK:n tiedotteen mukaan vastuu tutkimuksen sisällöstä, johtopäätöksistä ja luotettavuudesta säilyy aina tutkijalla. Tutkijoiden on myös tunnettava käyttämiensä tekoälyvälineiden keskeiset rajoitteet ja eettiset riskit. Suositus ohjeistaa lisäksi, miten tekoälyn käytöstä kerrotaan avoimesti ja miten se raportoidaan.

“Tekoäly voi tukea tutkimusta monin tavoin, mutta se ei korvaa tutkijan omaa harkintaa, asiantuntemusta eikä vastuuta.”

— Simo Kyllönen, Yliopistonlehtori, TENK:n suositusta valmistelleen työryhmän puheenjohtaja, TENK:n tiedotteessa kesäkuussa 2026

Pohdintaosiossa kielimallin jälkiä on kaksi kertaa niin usein kuin menetelmissä

Pohdintaosion tekstinpätkät, joissa kielimallin jälkiä68 %
Menetelmäosion tekstinpätkät, joissa kielimallin jälkiä32 %

Holzwarth, González-Márquez & Kobak, arXiv:2608.10715 (yhtä pitkät tekstinpätkät)

Sanasto

Vertaisarviointi
Tieteellisen julkaisun laadunvarmistus, jossa saman alan tutkijat lukevat ja arvioivat tutkimuksen ennen kuin lehti julkaisee sen.
Preprint
Tutkimusartikkelin ennakkoversio, joka julkaistaan avoimesti ennen vertaisarviointia. Sen tuloksia ei siis ole vielä tarkistettu tiedelehden normaalissa käsittelyssä.

TENK ei ole kommentoinut Tübingenin tutkimusta julkisesti.

Jos kielimallin jälkiä on lähes jokaisessa artikkelissa, pelkkä tieto tekoälyn käytöstä ei enää kerro lukijalle paljoa. Olennaisempaa on, missä kohdassa tekstiä mallia käytettiin. Menetelmäkuvauksen kieliasun hiominen on eri asia kuin johtopäätösten muotoilu. Avoimuutta vaativien ohjeiden todellinen koe on se, saadaanko tämä ero näkyviin.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 4Datakeskukset Suomessa – hankkeet, sähkö ja vero
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.