SpaceXAI julkaisi Grok 4.5:n yleisölle keskiviikkona 9. heinäkuuta. Elon Musk kutsuu mallia "Opus-luokan malliksi", mutta sen kiinnostavin luku ei löydy benchmark-taulukosta vaan hinnastosta.
Grok 4.5 maksaa 2 dollaria miljoonalta syöttötokenilta ja 6 dollaria miljoonalta ulostulotokenilta. Anthropicin Opus-mallilla vastaavat hinnat ovat 5 ja 25 dollaria. Ulostulo, joka koodaustyössä on se kallis pää, on Grokilla siis noin neljäsosan.
Halpuus, ei benchmark
SpaceXAI:n oma viesti on selvä: malli on nopeampi, token-tehokkaampi ja halvempi. Yhtiö sanoo Grokin käyttävän tehtäviin noin puolet vähemmän tokeneita kuin kilpailevat mallit. Se on kova väite, mutta myös maltillisempi kuin julkaisun ympärillä liikkunut markkinapuhe.
Ehdotuksissa ja someketjuissa luku on venynyt nelinkertaiseksi Opus 4.8:aan verrattuna. SpaceXAI ei kuitenkaan toista tuota väitettä virallisessa materiaalissaan, eikä riippumatonta testiä ole vielä nähty. Yhtiön oma sisäinen arvio kuvaa mallia "suunnilleen Opus 4.7:n veroiseksi, mutta paljon nopeammaksi" – ei siis uusimman 4.8:n.
Väitteet vielä vahvistamatta
SpaceXAI:n julkaisemat benchmarkit jäävät sen omankin materiaalin mukaan hitusen kärjen taakse. "Noin 4x" -tehokkuusväite ja tieto 1,5 biljoonan parametrin koosta tai Cursorin datalla kouluttamisesta perustuvat toistaiseksi markkinointiin ja huhuihin, eivät riippumattomaan mittaukseen. Suhtaudu "Opus-luokka"-leimaan varauksella, kunnes ulkopuoliset testit valmistuvat.
Token-tehokkuus kertautuu laskussa
Jos malli ratkoo saman koodaustehtävän pienemmällä token-määrällä ja jokainen token on vielä halvempi, säästö kertautuu. Karkea esimerkki: puolet vähemmän tokeneita neljäsosan hinnalla tarkoittaa, että sama tehtävä voi maksaa alle kymmenesosan Opusiin verrattuna.
Juuri tämä kertautuminen kiinnostaa jokaista, joka maksaa tekoälyagenttinsa API-laskun itse. Koodausagentti, joka käy läpi tuhansia tiedostoja ja tuottaa pitkiä vastauksia, polttaa ulostulotokeneita jatkuvasti. Siellä hinnan pudotus näkyy suoraan kuukausilaskussa.
“Opus-luokan malli, joka on nopeampi, token-tehokkaampi ja halvempi.”
Sanasto
Token
Tekstin perusyksikkö, jonka kielimalli käsittelee ja jonka mukaan tekoälypalvelun hinta lasketaan. Yksi token on noin puoli suomen sanaa. Syöttötoken on malliin menevä teksti, ulostulotoken mallin tuottama vastaus.
Benchmark
Vakioitu vertailutesti, jolla mitataan ja verrataan eri tekoälymallien suorituskykyä samoilla tehtävillä.
Mitä tämä tarkoittaa suomalaiselle kehittäjälle
Suomalaisille ohjelmistoyrityksille ja startupeille kyse on suoraan katteesta. Moni pieni tiimi rakentaa tuotteeseensa tekoälyominaisuuksia, joiden hinnoittelu kaatuu juuri mallin token-kustannuksiin. Kun ulostulotoken halpenee neljäsosaan, aiemmin liian kalliiksi todetut ominaisuudet muuttuvat yhtäkkiä kannattaviksi.
Käytännössä sama budjetti riittää useampaan ajokertaan, isompaan käyttäjämäärään tai raskaampiin agenttitehtäviin. Se on tavallisen tuotekehittäjän arjessa isompi juttu kuin yhden pykälän ero benchmark-taulukossa, jonka kärkeä harva sovellus oikeasti tarvitsee.
Se, yltääkö Grok 4.5 oikeasti Opus-luokkaan, ratkeaa vasta riippumattomissa testeissä. Mutta vaikka se jäisi hitusen kärjestä, hintapaine ei katoa. Halvempi haastaja pakottaa myös Anthropicin ja OpenAI:n perustelemaan, mistä asiakas oikeastaan maksaa – ja se hyödyttää kehittäjää riippumatta siitä, minkä mallin hän lopulta valitsee.
Viikoittainen uutiskirje
Tule firmasi fiksuimmaksi AI-osaajaksi
Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.