Koneoppiminen

OpenAI julkaisi avoimet mallinsa – miksi juuri nyt?

Ensimmäiset avoimet mallit kuuteen vuoteen haastavat Metan ja Mistralin.

Hanna HuulivuoHanna Huulivuo
Jaa:
OpenAI julkaisi avoimet mallinsa – miksi juuri nyt?

Kuusi vuotta hiljaisuutta

OpenAI julkaisi kaksi avointa kielimallia: gpt-oss-120b:n ja gpt-oss-20b:n. Molemmat tulivat saataville Apache 2.0 -lisenssillä, joka sallii rajoittamattoman kaupallisen käytön ja sisältää patenttilisenssin. Kyseessä on yhtiön ensimmäinen avoin mallipainojen julkaisu sitten GPT-2:n vuonna 2019.

Julkaisua edelsi julkinen itsetutkiskelu. Sam Altman myönsi Reddit-keskustelussa, ettei yhtiö ole toiminut avoimuuskysymyksessä oikein. Tunnustus konkretisoitui kahtena mallina Hugging Facessa.

“Uskon henkilökohtaisesti, että olemme olleet väärällä puolella historiaa, ja meidän täytyy miettiä toisenlainen avoimen lähdekoodin strategia.”

— Sam Altman, OpenAI:n toimitusjohtaja

Iso malli yhdelle näytönohjaimelle

Mallien arkkitehtuuri perustuu mixture-of-experts-rakenteeseen (MoE), jossa vain osa parametreista aktivoituu kunkin syötteen kohdalla. gpt-oss-120b sisältää 117 miljardia parametria, mutta aktivoi niistä vain 5,1 miljardia kerrallaan. Pienempi gpt-oss-20b sisältää 21 miljardia parametria ja aktivoi 3,6 miljardia.

MXFP4-kvantisoinnin ansiosta gpt-oss-120b mahtuu yhdelle 80 gigatavun H100-näytönohjaimelle. Moni kilpaileva malli vaatii useamman huippunäytönohjaimen. Pienempi malli toimii 16 gigatavun kuluttajanäytönohjaimella, kuten Nvidian RTX 3090:llä tai 4090:llä. Hugging Facen keskustelupalstalla eräs käyttäjä raportoi pienemmän mallin tuottavan 16 merkkiä sekunnissa noin 2 000 euron minitietokoneella.

Suorituskyvyssä gpt-oss-120b yltää lähelle OpenAI:n omaa o4-miniä. MMLU-testissä isompi malli saa 90 prosenttia ja GPQA-testissä 80,1 prosenttia. MMLU-Pro-testissä tulos on niin ikään 90 prosenttia, kun DeepSeek R1 yltää 85 prosenttiin ja Alibaban Qwen3 jää 84,4 prosenttiin. Pienempi gpt-oss-20b saa MMLU-testissä 85,3 prosenttia, mikä vastaa o3-minin tasoa.

Mallien konteksti-ikkuna on 128 000 merkkiä. Arkkitehtuurissa vuorottelevat täyskontekstikerrokset ja 128 merkin liukuvaan ikkunaan rajatut kerrokset, mikä tasapainottaa tarkkuutta ja nopeutta.

Kolme syytä avautumisen takana

OpenAI:n linjanmuutosta ei selitä idealismi. Takana on kolme konkreettista painetekijää.

Ensimmäinen on kilpailu. Kiinalainen DeepSeek julkaisi tammikuussa 2025 avoimen R1-mallinsa, joka tarjosi kilpailukykyistä suorituskykyä murto-osalla kustannuksista ja ravisteli samalla markkinoita. Metan Llama-mallisarja oli vakiinnuttanut asemansa avoimen tekoälyn standardina, ja ranskalainen Mistral kasvatti osuuttaan Euroopassa. OpenAI oli vaarassa menettää kehittäjäyhteisön, joka rakentaa tuotteitaan yhä useammin kilpailijoiden mallien varaan.

Toinen painetekijä on sääntely. EU:n tekoälysäädös asettaa tiukemmat vaatimukset suljetuille, järjestelmäriskiksi luokitelluille malleille. Avoimet mallit voivat nauttia kevyemmästä sääntelykehyksestä, ja avoin julkaisu auttaa OpenAI:ta navigoimaan eurooppalaista sääntelykenttää.

Kolmas tekijä on asiakaskysyntä. Yhä useammat yritykset haluavat ajaa tekoälymalleja omissa ympäristöissään tietoturva-, yksityisyys- ja kustannussyistä. Apache 2.0 -lisenssi mahdollistaa tämän ilman rajoituksia ja avaa OpenAI:lle uuden asiakassegmentin.

Kokeile itse

gpt-oss-mallien painot ovat ladattavissa Hugging Facesta (openai/gpt-oss-120b ja openai/gpt-oss-20b). Lähdekoodi ja käyttöohjeet löytyvät OpenAI:n GitHub-repositoriosta. Pienemmän mallin voi ajaa paikallisesti 16 gigatavun näytönohjaimella esimerkiksi llama.cpp:n tai vLLM:n avulla.

OpenAI:n kaksi avointa mallia

gpt-oss-120b

Huippuluokan avoin malli

Parametrit
117 mrd (5,1 mrd aktiivista)
MMLU-Pro
90 %
GPU-vaatimus
1× H100 (80 Gt)
Konteksti
128 000 tokenia

gpt-oss-20b

Paikallisesti ajettava malli

Parametrit
21 mrd (3,6 mrd aktiivista)
MMLU
85,3 %
GPU-vaatimus
1× RTX 4090 (16 Gt)
Konteksti
128 000 tokenia

OpenAI, 2026

Sanasto

Mallipainot
Kielimallin sisäiset lukuarvot, jotka syntyvät koulutuksen tuloksena ja määräävät miten malli käsittelee kieltä. Painojen julkaiseminen mahdollistaa mallin ajamisen omalla laitteistolla.
Kvantisointi
Tekoälymallin pakkaustekniikka, jossa mallin sisäisiä lukuarvoja pyöristetään karkeampaan tarkkuuteen. Näin malli vie vähemmän muistia ja mahtuu pienempään laitteistoon.
Konteksti-ikkuna
Tekstin enimmäismäärä, jonka kielimalli pystyy käsittelemään kerralla. Mitä suurempi ikkuna, sitä pidempiä dokumentteja tai keskusteluja malli voi huomioida vastatessaan.

Uusi voimatasapaino

gpt-oss-mallien julkaisu muuttaa avoimen tekoälyn kilpailuasetelmaa. Aiemmin kehittäjät valitsivat Metan Llaman tai pienempien toimijoiden, kuten Mistralin, mallien väliltä. Nyt mukana on OpenAI, jonka mallien taustalla on sama tutkimusosaaminen kuin suljettujen GPT-4:n ja o-sarjan takana.

Käytännössä tämä tarkoittaa, että pienet yritykset ja tutkijat voivat rakentaa tuotteitaan päättelykykyisen mallin varaan ilman API-kustannuksia. Suomessa Aalto-yliopiston ja VTT:n kaltaiset tutkimuslaitokset voivat hienosäätää huippumallia omilla aineistoillaan. Tekoäly-yritykset voivat pitää arkaluontoiset tiedot omissa käsissään.

Avoimuuskäänne ei silti tee OpenAI:sta avoimen lähdekoodin yhtiötä. ChatGPT, GPT-5 ja o-sarja pysyvät suljettuina. gpt-oss on strateginen myönnytys kilpailupaineen edessä, ei suunnanmuutos. OpenAI pelaa nyt samaa peliä kuin Meta: avoimet mallit houkuttelevat kehittäjiä ekosysteemiin, ja kaupallinen arvo syntyy maksullisista palveluista niiden päällä.

Ratkaiseva testi on, tuleeko jatkoa. Jos gpt-oss jää yksittäiseksi julkaisuksi, se muistetaan taktisena siirtona. Jos OpenAI jatkaa avoimien mallien sarjaa ja päivittää niitä aktiivisesti, yhtiö voi aidosti haastaa Metan johtoaseman avoimen tekoälyn kentällä.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 4Datakeskukset Suomessa – hankkeet, sähkö ja vero
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.