Tekoäly

Mistral avasi 128 asiantuntijan mallin kaikille

Small 4 osaa päätellä, nähdä ja koodata – täysin avoimella lisenssillä

Aino AikajärviAino Aikajärvi
Jaa:
Mistral avasi 128 asiantuntijan mallin kaikille

Ranskalainen Mistral AI julkaisi maanantaina Small 4 -mallin: 119 miljardia parametria, 128 erikoistunutta asiantuntijamoduulia ja avoin Apache 2.0 -lisenssi. Julkistus tapahtui Nvidian vuotuisessa GTC-konferenssissa. Samalla Nvidia ilmoitti perustavansa Nemotron-koalition avoimen tekoälyn edistämiseksi ja nimesi Mistralin sen ensimmäiseksi kumppaniksi.

128 asiantuntijaa, mutta vain neljä töissä kerrallaan

Small 4 perustuu MoE-arkkitehtuuriin (Mixture of Experts), jossa malli jakautuu 128 erikoistuneeseen asiantuntijamoduuliin. Jokaista kyselyä kohden aktivoituu vain neljä asiantuntijaa eli noin kuusi miljardia parametria. Kokonaisparametrimäärä on 119 miljardia, mutta todellinen laskentakuorma vastaa murto-osaa siitä.

Perinteisessä tiheässä mallissa jokainen parametri osallistuu jokaiseen kyselyyn. MoE-lähestymistapa kääntää tämän päälaelleen: malli valitsee kuhunkin tehtävään sopivimmat asiantuntijat ja jättää loput lepotilaan. Tulos näkyy sekä nopeudessa että kustannuksissa. Mistralin mukaan Small 4 vastaa 40 prosenttia nopeammin ja käsittelee kolme kertaa enemmän kyselyjä sekunnissa kuin edeltäjänsä Small 3.

MoE ei ole uusi idea – Googlen tutkijat esittelivät periaatteen jo vuosia sitten – mutta Mistral on onnistunut pakkaamaan sen kaupallisesti kilpailukykyiseen ja täysin avoimeen malliin. Konteksti-ikkuna ulottuu 256 000 tokeniin, mikä riittää satojen sivujen dokumenttien käsittelyyn yhdellä kertaa. Yrityskäytössä tämä tarkoittaa, että Small 4 tarjoaa ison mallin kapasiteetin pienemmällä rautainvestoinnilla ja matalammilla käyttökustannuksilla.

Päättely, kuvat ja koodaus samassa paketissa

Small 4 yhdistää neljä aiemmin erillistä kykyä yhteen malliin: nopean ohjeistuksen seuraamisen, säädettävän päättelyn, kuvien tulkinnan ja agenttipohjaisen koodauksen. Aiemmin kehittäjän olisi pitänyt ketjuttaa useampi erikoismalli peräkkäin saadakseen vastaavan tuloksen.

Käytännössä yhdellä mallilla voi nyt rakentaa sovelluksen, joka analysoi kuvakaappauksen, päättelee mitä siinä näkyy ja kirjoittaa koodia ratkaisuksi. Uusi reasoning_effort-parametri antaa käyttäjälle hallinnan päättelyn syvyyteen: kevyemmällä asetuksella malli vastaa nopeasti, raskaammalla se tuottaa analyyttisempiä vastauksia Magistral-erikoismallin tasolla.

Benchmarkeissa Small 4 erottuu tiiviydellään. Mistralin mittauksissa mallin vastausten keskipituus on 1 600 merkkiä, kun kilpailijoilla vastaava luku on 5 800–6 100 merkkiä. LiveCodeBench-koodaustestissä malli päihittää GPT-OSS 120B:n samalla kun tuotettu koodi on 20 prosenttia lyhyempää. Tiiviyden merkitys on käytännöllinen: lyhyemmät vastaukset kuluttavat vähemmän laskentatehoa ja tulevat halvemmiksi.

Googlen Gemma 3:een ja OpenAI:n GPT-4o-miniin verrattuna Small 4 tuo harppauksen erityisesti monipuolisuudessa. Aiemmat pienet mallit ovat tyypillisesti erikoistuneet yhteen tai kahteen tehtävään. Mistral pyrkii osoittamaan, että yksi avoin malli voi hoitaa sen, mihin on aiemmin tarvittu useampaa. Pienemmille kehitystiimeille tämä on käytännössä iso asia: yksi malli on helpompi ottaa käyttöön ja ylläpitää kuin kolme.

Nvidia-koalitio ja avoin lisenssi

Julkistuksen ajoitus ei ollut sattumaa. Nvidia perusti samana päivänä Nemotron-koalition, jonka tehtävä on edistää avoimia huipputason perusmalleja. Kahdeksan perustajajäsenen joukossa ovat Mistralin lisäksi muun muassa koodieditori Cursor, hakukone Perplexity ja tekoälykehys LangChain. Koalition ensimmäinen hanke on yhteinen perusmalli, jonka Mistral ja Nvidia kehittävät DGX Cloud -infrastruktuurilla.

Apache 2.0 -lisenssi tarkoittaa, että kuka tahansa voi ladata Small 4:n, muokata sitä ja käyttää kaupallisissa sovelluksissa ilman rajoituksia. Kyseessä on yksi vapaimmista avoimen lähdekoodin lisensseistä. Tämä erottaa Small 4:n esimerkiksi Metan Llama-malleista, joissa käyttöehdot rajaavat suurimpia toimijoita pois. Eurooppalaisille yrityksille avoin lisenssi on erityisen arvokas: malleja voi räätälöidä omiin tarpeisiin ilman riippuvuutta suljetuista yhdysvaltalaisista palveluista.

Malli on ladattavissa Hugging Facesta ja käytettävissä Mistralin API:n sekä Nvidian NIM-alustan kautta. Ajaminen vaatii vähintään neljä Nvidia H100-näytönohjainta, joten kyseessä on palvelinluokan ratkaisu, ei kotikoneille tarkoitettu työkalu.

119 mrd

Kokonaisparametrit

4 / 128

Aktiivista asiantuntijaa per kysely

+40 %↑

Nopeampi kuin edeltäjä Small 3

3×↑

Enemmän kyselyjä sekunnissa

Mistral AI, 2026

Sanasto

Token
Tekstin perusyksikkö jonka kielimalli käsittelee. Yksi token on noin ¾ englanninkielistä sanaa eli suomeksi noin puoli sanaa.
Konteksti-ikkuna
Kielimallille kerralla syötettävän tekstin enimmäismäärä. Isompi konteksti-ikkuna tarkoittaa, että malli pystyy käsittelemään pidempiä dokumentteja yhdellä kertaa.

Suomalainen kytkös Mistraliin

Silo AI, yksi Euroopan suurimmista tekoälylaboratorioista, solmi vuonna 2025 kumppanuuden Mistralin kanssa. Helsinkiläisyhtiö integroi Mistralin malleja suomalaisten ja eurooppalaisten yritysasiakkaiden ratkaisuihin ja tarjoaa niihin räätälöintipalveluja. Small 4:n kaltainen avoin ja tehokas malli sopii erityisen hyvin tähän lähestymistapaan, jossa suuret kielimallit hienosäädetään toimialakohtaisiin tarpeisiin. Silo AI on aiemmin rakentanut muun muassa pohjoismaisia kielimalleja, joten osaaminen eurooppalaisten mallien soveltamisessa on vahvalla pohjalla.

Käytännön merkitys suomalaisille yrityksille on konkreettinen: Apache 2.0 -lisenssi mahdollistaa mallin ajamisen omilla palvelimilla, jolloin arkaluontoinen data pysyy organisaation hallinnassa. Esimerkiksi terveysteknologiayritys voi hienosäätää mallin tunnistamaan suomenkielisiä potilaskertomuksia ilman, että data kulkee Atlantin yli. Teollisuudessa ja julkishallinnossa tämä tietosuojatakuu on usein ehdoton vaatimus ennen kuin tekoälyratkaisua edes harkitaan.

Mistralin nousu muistuttaa siitä, että tekoälyn kehitys ei ole pelkästään Piilaakson ja Pekingin käsissä. Nvidian päätös rakentaa koalitio ranskalaisen yhtiön ympärille kertoo, että Euroopalla on tekoälyssä enemmän painoarvoa kuin julkinen keskustelu antaa ymmärtää.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.