Otetaan esimerkiksi ohjelmistokehittäjä, jonka koodausavustaja tekee päivän aikana satoja pieniä töitä. Se lukee tiedostoja, tiivistää lokeja, nimeää muuttujia ja ehdottaa testejä. Suurin osa pyynnöistä on rutiinia. Järeämpää mallia tarvitaan vasta, kun vastaan tulee hankala arkkitehtuurimuutos tai bugi, jota kukaan ei ymmärrä.
Sama jako näkyy nyt Vercelin luvuissa. Pilvialusta Vercel kertoo 17. syyskuuta julkaistussa AI Gateway -raportissaan, että avoimet mallit käsittelivät elokuussa 56 prosenttia sen tekoälyrajapinnan kautta kulkeneista tokeneista. Joulukuussa 2025 osuus oli 7 prosenttia.
Rahoista avoimet mallit saivat paljon pienemmän osan. Asiakkaiden kulutuksesta niille jäi elokuussa 14 prosenttia. Anthropic keräsi yksin 64 prosenttia kaikesta rahasta, joka AI Gatewayn kautta käytettiin.
Tokenit ja rahat kertovat eri tarinaa
Token on tekstin pala, jonka kielimalli lukee tai kirjoittaa. Vercel laskee mukaan myös päättelyyn kuluneet tokenit sekä välimuistista luetun ja sinne tallennetun syötteen. Agenttikäytössä malli lukee samaa kontekstia uudelleen kierros kierrokselta, joten tokeneita kertyy nopeasti valtavia määriä.
Avoimet mallit tekivät siis yli puolet työstä ja saivat noin seitsemäsosan rahoista, joten hintaero on suuri. AI Suomen karkean laskelman mukaan suljettujen mallien keskimääräinen tokenihinta oli Vercelin aineistossa elokuussa lähes kahdeksankertainen avoimiin malleihin verrattuna. Laskelma perustuu Vercelin ilmoittamiin osuuksiin, jotka on laskettu julkisilla listahinnoilla. Asiakkaiden todelliset sopimushinnat voivat poiketa niistä.
“Avoimet mallit ajoivat ensimmäistä kertaa suurimman osan gatewayn tokeneista, kun osuus nousi joulukuun 7 prosentista elokuun 56 prosenttiin.”
Anthropicin asema ei ole hetkellinen. Raportin mukaan yhtiö on saanut joka kuukausi joulukuusta lähtien vähintään 61 senttiä jokaisesta AI Gatewayn kautta käytetystä dollarista. Elokuussa osuus oli 64 senttiä.
Halpa riittää, kunnes ei riitä
Vercel ei erittele, mihin tehtäviin avoimia malleja käytetään. Alan tavalliset käytännöt selittävät silti paljon. Luokittelussa, tiivistämisessä, tiedon poimimisessa asiakirjoista ja agentin välivaiheissa virhe on halpa korjata ja pyyntöjä on paljon. Niihin kelpaa hieman heikompikin malli, jos se maksaa murto-osan.
Kallista mallia tarvitaan, kun virhe maksaa. Laajan koodimuutoksen suunnittelussa, monivaiheisessa päättelyssä tai suoraan asiakkaalle menevässä vastauksessa kehittäjä valitsee mieluummin varman kuin halvan mallin. Vercelin luvuissa raha valuu juuri näihin tehtäviin.
Hinnalla on väliä myös kalliiden mallien kesken. Kun Opus 5 tuli markkinoille noin puolella Fable 5:n hinnasta, Fablen osuus kulutuksesta putosi kuukaudessa 13,2 prosentista 4,9 prosenttiin. Raportin mukaan yhdeksän kymmenestä Fablea käyttäneestä tiimistä vähensi sen käyttöä. Opus 5:een siirtyi enemmän tiimejä kuin mihinkään muuhun malliin.
Googlelle kävi huonommin. Gemini 3 Flashin osuus tokeneista on toukokuun jälkeen pudonnut 95 prosenttia, ja yli kolme neljäsosaa menetetystä volyymista siirtyi muille yhtiöille. Tokenien keskihinta laski elokuussa 23,2 prosenttia, mikä on jyrkin pudotus kuukausiin.
Kiinalaiset mallit OpenRouterissa
Samansuuntaisia lukuja on raportoitu muualtakin. CNBC kertoi 26. syyskuuta, että kiinalaisten mallien osuus OpenRouter-palvelun tokeneista on ollut 57–67 prosenttia. OpenRouter on Vercelin tavoin välityspalvelu, jonka kautta kehittäjät voivat käyttää satoja malleja saman rajapinnan kautta. AI Suomi ei päässyt tarkistamaan lukua CNBC:n alkuperäisestä jutusta, eikä selvinnyt, mitä ajanjaksoa se koskee.
Molemmat luvut koskevat vain palvelujen omia asiakkaita. Luvuissa eivät näy lainkaan suuryritykset, jotka ostavat mallit suoraan OpenAI:lta, Anthropicilta tai Googlelta, eivätkä yritykset, jotka pyörittävät avoimia malleja omilla palvelimillaan. Välityspalveluja käyttävät erityisesti kehittäjät, jotka haluavat vaihtaa mallia helposti. Siksi halvat mallit korostuvat niissä todennäköisesti enemmän kuin markkinoilla keskimäärin.
Mitä Vercelin luvut kattavat
Raportti perustuu anonymisoituun ja koottuun liikenteeseen, joka kulkee Vercelin AI Gatewayn kautta. Kulutus on laskettu julkisilla listahinnoilla. Kun raportti kertoo volyymin siirtymisestä mallista toiseen, se vertaa samojen tiimien käyttöä eikä seuraa yksittäisiä tokeneita. Vercel ei kerro, montako asiakasta aineistossa on.



