Biljoonan parametrin malli kiinalaisilla siruilla
Kiinalainen tekoäly-yhtiö DeepSeek julkaisi maaliskuun alussa V4-mallinsa, joka on toistaiseksi kunnianhimoisin avoimena lähdekoodina julkaistu tekoälymalli. Biljoonan parametrin Mixture-of-Experts-arkkitehtuuri pyörii kokonaan Huawein Ascend- ja Cambricon-siruilla ilman yhtäkään amerikkalaista prosessoria.
Julkaisun ajankohta ei ollut sattumaa. V4 esiteltiin juuri ennen Kiinan vuosittaista kansankongressia, jossa tekoäly on noussut keskeiseksi strategiseksi teemaksi. Malli käsittelee tekstiä, kuvia, videota ja ääntä natiivisti, sillä multimodaalisuus on rakennettu arkkitehtuuriin alusta asti eikä lisätty jälkikäteen sovitinkerroksilla. Konteksti-ikkuna ylittää miljoona tokenia.
Vaikka kokonaisparametrimäärä on biljoona, yksittäiseen päättelyyn aktivoituu noin 32 miljardia parametria. Mixture-of-Experts-rakenne pitää laskentakustannukset ja viiveen hallinnassa, vaikka mallin kokonaiskapasiteetti kilpailee suurimpien suljettujen mallien kanssa.
Kolme teknistä läpimurtoa
DeepSeek V4:ssä ei ole kyse pelkästä parametrien kasaamisesta. Malli esittelee kolme uutta arkkitehtuuriratkaisua. Manifold-Constrained Hyper-Connections vakauttaa koulutusprosessia biljoonan parametrin mittakaavassa, Engram Conditional Memory tehostaa tiedonhakua miljoonan tokenin kontekstista ja Lightning Indexer nopeuttaa pitkien syötteiden käsittelyä harvalla attention-mekanismilla.
Sisäisissä vertailuissa V4 pärjää koodaustehtävissä lähes Claude Opus 4.6:n ja GPT-5:n tasolla, ja monikielisyydessä se ohittaa molemmat. Hintaero on dramaattinen: DeepSeek V4 on arvioiden mukaan noin 50 kertaa edullisempi syötetokeneissa kuin Claude Opus. Riippumattomia vertailutuloksia ei kuitenkaan ole vielä vahvistettu.
Vientirajoitukset eivät pysäyttäneet
DeepSeek V4 on konkreettisin osoitus siitä, että Yhdysvaltain vientirajoitukset eivät ole pysäyttäneet Kiinan tekoälykehitystä. Trumpin hallinto on kiristänyt valvontaa merkittävästi: Entity Listille on lisätty kymmeniä kiinalaisia toimijoita, Nvidian H20-piirin vienti Kiinaan vaatii erillistä lupaa, ja Yhdysvallat on julistanut Huawein Ascend-sirujen käytön missä tahansa maailmassa amerikkalaisten vientisäädösten vastaiseksi.
DeepSeekin vastaus on ollut strateginen. Helmikuun lopussa uutisoitiin, että yhtiö esti Nvidian ja AMD:n pääsyn V4:n esijulkaisuversioon. Tämä rikkoi alan vakiintuneen käytännön, jossa sirunvalmistajat optimoivat tuotteensa uusille malleille etukäteen. Samaan aikaan Huawein Ascend-yksikkö sai viikkojen etumatkan V4:n arkkitehtuurin optimointiin.
Viesti on selvä. DeepSeek rakentaa rinnakkaista tekoälyekosysteemiä, joka ei ole riippuvainen amerikkalaisesta laitteistosta. Sirusota ei ole enää pelkästään siruista vaan ohjelmistoekosysteemien hallinnasta.
Avoin lähdekoodi kiristää kilpailua
V4 julkaistiin Apache 2.0 -lisenssillä, joten kuka tahansa voi käyttää, muokata ja jakaa mallia kaupallisesti. Se kilpailee suoraan Metan Llama-mallien ja Alibaban Qwen-sarjan kanssa avoimen lähdekoodin tekoälyn kärkipaikasta.
Suomalaisille yrityksille ja tutkijoille kehitys avaa uusia mahdollisuuksia. Avoimen mallin käyttö ei vaadi suuria API-budjetteja, ja sitä voi ajaa omilla palvelimilla ilman toimittajalukkoa. Sitran johtava asiantuntija Tarmo Toikkanen on kuitenkin kehottanut varovaisuuteen: DeepSeekin menestys osoittaa, ettei tekoälykehitys vaadi rajattomia resursseja, mutta kiinalaisten palveluntarjoajien läheinen suhde valtioon pakottaa pohtimaan, mihin käyttäjien data päätyy.
Silo AI:n perustaja Peter Sarlin on aiemmin arvioinut DeepSeekin mallien merkittävimmän piirteen olevan niiden energiatehokkuus. V4 vie ajatusta pidemmälle: se osoittaa, että tehokkuusinnovaatiot voivat kompensoida laitteiston rajoitteita.



