Kuusi vuotta hiljaisuutta
OpenAI julkaisi kaksi avointa kielimallia: gpt-oss-120b:n ja gpt-oss-20b:n. Molemmat tulivat saataville Apache 2.0 -lisenssillä, joka sallii rajoittamattoman kaupallisen käytön ja sisältää patenttilisenssin. Kyseessä on yhtiön ensimmäinen avoin mallipainojen julkaisu sitten GPT-2:n vuonna 2019.
Julkaisua edelsi julkinen itsetutkiskelu. Sam Altman myönsi Reddit-keskustelussa, ettei yhtiö ole toiminut avoimuuskysymyksessä oikein. Tunnustus konkretisoitui kahtena mallina Hugging Facessa.
“Uskon henkilökohtaisesti, että olemme olleet väärällä puolella historiaa, ja meidän täytyy miettiä toisenlainen avoimen lähdekoodin strategia.”
Iso malli yhdelle näytönohjaimelle
Mallien arkkitehtuuri perustuu mixture-of-experts-rakenteeseen (MoE), jossa vain osa parametreista aktivoituu kunkin syötteen kohdalla. gpt-oss-120b sisältää 117 miljardia parametria, mutta aktivoi niistä vain 5,1 miljardia kerrallaan. Pienempi gpt-oss-20b sisältää 21 miljardia parametria ja aktivoi 3,6 miljardia.
MXFP4-kvantisoinnin ansiosta gpt-oss-120b mahtuu yhdelle 80 gigatavun H100-näytönohjaimelle. Moni kilpaileva malli vaatii useamman huippunäytönohjaimen. Pienempi malli toimii 16 gigatavun kuluttajanäytönohjaimella, kuten Nvidian RTX 3090:llä tai 4090:llä. Hugging Facen keskustelupalstalla eräs käyttäjä raportoi pienemmän mallin tuottavan 16 merkkiä sekunnissa noin 2 000 euron minitietokoneella.
Suorituskyvyssä gpt-oss-120b yltää lähelle OpenAI:n omaa o4-miniä. MMLU-testissä isompi malli saa 90 prosenttia ja GPQA-testissä 80,1 prosenttia. MMLU-Pro-testissä tulos on niin ikään 90 prosenttia, kun DeepSeek R1 yltää 85 prosenttiin ja Alibaban Qwen3 jää 84,4 prosenttiin. Pienempi gpt-oss-20b saa MMLU-testissä 85,3 prosenttia, mikä vastaa o3-minin tasoa.
Mallien konteksti-ikkuna on 128 000 merkkiä. Arkkitehtuurissa vuorottelevat täyskontekstikerrokset ja 128 merkin liukuvaan ikkunaan rajatut kerrokset, mikä tasapainottaa tarkkuutta ja nopeutta.
Kolme syytä avautumisen takana
OpenAI:n linjanmuutosta ei selitä idealismi. Takana on kolme konkreettista painetekijää.
Ensimmäinen on kilpailu. Kiinalainen DeepSeek julkaisi tammikuussa 2025 avoimen R1-mallinsa, joka tarjosi kilpailukykyistä suorituskykyä murto-osalla kustannuksista ja ravisteli samalla markkinoita. Metan Llama-mallisarja oli vakiinnuttanut asemansa avoimen tekoälyn standardina, ja ranskalainen Mistral kasvatti osuuttaan Euroopassa. OpenAI oli vaarassa menettää kehittäjäyhteisön, joka rakentaa tuotteitaan yhä useammin kilpailijoiden mallien varaan.
Toinen painetekijä on sääntely. EU:n tekoälysäädös asettaa tiukemmat vaatimukset suljetuille, järjestelmäriskiksi luokitelluille malleille. Avoimet mallit voivat nauttia kevyemmästä sääntelykehyksestä, ja avoin julkaisu auttaa OpenAI:ta navigoimaan eurooppalaista sääntelykenttää.
Kolmas tekijä on asiakaskysyntä. Yhä useammat yritykset haluavat ajaa tekoälymalleja omissa ympäristöissään tietoturva-, yksityisyys- ja kustannussyistä. Apache 2.0 -lisenssi mahdollistaa tämän ilman rajoituksia ja avaa OpenAI:lle uuden asiakassegmentin.
Kokeile itse
gpt-oss-mallien painot ovat ladattavissa Hugging Facesta (openai/gpt-oss-120b ja openai/gpt-oss-20b). Lähdekoodi ja käyttöohjeet löytyvät OpenAI:n GitHub-repositoriosta. Pienemmän mallin voi ajaa paikallisesti 16 gigatavun näytönohjaimella esimerkiksi llama.cpp:n tai vLLM:n avulla.



