Google julkaisi Gemma 4 -malliperheen, joka koostuu neljästä erikokoisesta kielimallista. Kaikki julkaistiin Apache 2.0 -lisenssillä ilman minkäänlaisia käyttörajoituksia. Tämä on ensimmäinen kerta, kun Google tarjoaa parhaat avoimet mallinsa täysin vapaasti kaupalliseen käyttöön. Gemma 4 perustuu samaan tutkimukseen kuin Googlen suljettu Gemini-mallisto, mutta on optimoitu toimimaan huomattavasti pienemmillä resursseilla.
Neljä mallia, yksi lisenssi
Malliperheen suurin on 31 miljardin parametrin tiheä malli, joka sijoittuu kolmanneksi maailman avoimien mallien vertailussa. Se keräsi Chatbot Arenassa noin 1 380 Elo-pistettä, mikä asettaa sen samalle tasolle huomattavasti suurempien mallien kanssa.
Perheeseen kuuluvat myös 26 miljardin parametrin MoE-malli, jossa vain 3,8 miljardia parametria on aktiivisena kerrallaan, sekä kaksi reunalaitteille suunniteltua mallia: E4B (4,5 miljardia parametria) ja E2B (2,3 miljardia parametria). Kaikki tukevat tekstin ja kuvien käsittelyä, ja pienimmät mallit ymmärtävät myös ääntä. Kokovalikoima ulottuu siis 2,3 miljardista 31 miljardiin parametriin.
Gemma 4 vastaan Llama ja Mistral
Avoimen tekoälyn kenttä on nyt kolmen suuren toimijan hallinnassa: Metan Llama 4, Mistralin Small 4 ja Googlen Gemma 4. Jokainen lähestyy ongelmaa eri tavalla.
Gemma 4:n 31B-malli sai MMLU Pro -testissä 85,2 prosenttia ja AIME 2026 -matematiikkatestissä 89,2 prosenttia. LiveCodeBench v6:ssa, joka mittaa koodinkirjoitustaitoa käytännön tehtävissä, tulos oli 80,0 prosenttia. Tulokset ovat kilpailukykyisiä malleihin verrattuna, joissa on moninkertaisesti enemmän parametreja.
Llama 4 Scout tarjoaa poikkeuksellisen pitkän, 10 miljoonan tokenin konteksti-ikkunan, mutta Metan lisenssi rajoittaa kaupallista käyttöä: erillinen lupa vaaditaan, jos palvelulla on yli 700 miljoonaa kuukausittaista käyttäjää. Rajoitus ei käytännössä koske suomalaisia yrityksiä, mutta lisenssin periaatteellinen rajoittuneisuus voi hidastaa investointipäätöksiä. Mistral Small 4 on puolestaan tehokkuuden mestari – se aktivoi vain 6 miljardia parametria 119 miljardin kokonaismäärästä ja käyttää niin ikään Apache 2.0 -lisenssiä. Koodaustehtävissä Mistral on vahva haastaja.
Gemma 4 erottuu malliperheen laajuudella: sama arkkitehtuuri skaalautuu puhelimesta palvelinkeskukseen, ja kaikki neljä mallia jakavat saman lisenssin.
Miksi lisenssi ratkaisee
Avoin lähdekoodi ei tarkoita tekoälymaailmassa aina samaa asiaa. Metan Llama-malleissa on käyttäjämäärärajoitus, ja monet niin sanotut avoimet mallit sisältävät ehtoja, jotka rajoittavat kaupallista käyttöä tai edellyttävät erillisiä sopimuksia.
Gemma 4:n Apache 2.0 -lisenssi on yksiselitteinen: mallia saa käyttää, muokata ja jakaa vapaasti mihin tahansa tarkoitukseen. Googlen aikaisemmat Gemma-mallit käyttivät räätälöityä lisenssiä, joka rajoitti muokattujen painojen jakelua ja asetti käyttäjämääräkattoja kaupallisille sovelluksille. Nyt nämä rajoitukset on poistettu. Kyseessä on Googlen ensimmäinen aidosti avoin julkaisu Gemma-perheessä.
Käytännössä suomalainen yritys voi rakentaa Gemma 4:n päälle kaupallisen tuotteen, hienosäätää mallia omalla datallaan ja jakaa tulokset eteenpäin ilman juridista huolta. Ei tarvitse murehtia käyttäjämäärärajoista tai lisenssien muuttumisesta jälkikäteen. Se on konkreettinen ero verrattuna API-palveluihin, joiden hinnoittelu ja ehdot voivat muuttua ilman varoitusta.
Tekoälyä ilman pilveä
Gemma 4 -perheen pienin malli E2B pyörii alle 1,5 gigatavun muistilla. Raspberry Pi 5:llä se käsittelee 133 tokenia sekunnissa esikäsittelyvaiheessa ja tuottaa 7,6 tokenia sekunnissa vastausta generoitaessa. Kyseessä ei ole demotemppu, vaan käyttökelpoinen suorituskyky moniin sovelluksiin.
Pienimmät mallit kykenevät myös monivaiheiseen suunnitteluun, työkalujen kutsumiseen ja itsenäiseen päätöksentekoon. Reunalaitteella pyörivä tekoälyagentti, joka toimii ilman verkkoyhteyttä, on ollut pitkään teoreettinen mahdollisuus. Gemma 4 tekee siitä ensi kertaa realistisen.
Mahdollisuus ajaa mallia paikallisesti avaa oven sovelluksille, joissa pilvipalvelu ei ole vaihtoehto. Teollisuusautomaatio, terveydenhuollon laitteet ja yksityisyyskriittiset järjestelmät hyötyvät mallista, joka ei lähetä dataa minnekään. Suomen kaltaisessa maassa, jossa tietosuoja ja digitaalinen omavaraisuus ovat arvostettuja, paikallisesti ajettava tekoäly on kiinnostava vaihtoehto.
Malli tukee yli 140 kieltä, ja 128 000 tokenin konteksti-ikkuna mahdollistaa laajojen dokumenttien käsittelyn yhdellä syötteellä. Suuremmat mallit tarjoavat jopa 256 000 tokenin ikkunan.



