Tekoäly

DeepSeek V4: biljoona parametria, nolla Nvidia-sirua

Huawein siruilla pyörivä malli haastaa Yhdysvaltain vientirajoitukset

Nelli NelisanomaNelli Nelisanoma
Jaa:
DeepSeek V4: biljoona parametria, nolla Nvidia-sirua

Biljoonan parametrin malli kiinalaisilla siruilla

Kiinalainen tekoäly-yhtiö DeepSeek julkaisi maaliskuun alussa V4-mallinsa, joka on toistaiseksi kunnianhimoisin avoimena lähdekoodina julkaistu tekoälymalli. Biljoonan parametrin Mixture-of-Experts-arkkitehtuuri pyörii kokonaan Huawein Ascend- ja Cambricon-siruilla ilman yhtäkään amerikkalaista prosessoria.

Julkaisun ajankohta ei ollut sattumaa. V4 esiteltiin juuri ennen Kiinan vuosittaista kansankongressia, jossa tekoäly on noussut keskeiseksi strategiseksi teemaksi. Malli käsittelee tekstiä, kuvia, videota ja ääntä natiivisti, sillä multimodaalisuus on rakennettu arkkitehtuuriin alusta asti eikä lisätty jälkikäteen sovitinkerroksilla. Konteksti-ikkuna ylittää miljoona tokenia.

Vaikka kokonaisparametrimäärä on biljoona, yksittäiseen päättelyyn aktivoituu noin 32 miljardia parametria. Mixture-of-Experts-rakenne pitää laskentakustannukset ja viiveen hallinnassa, vaikka mallin kokonaiskapasiteetti kilpailee suurimpien suljettujen mallien kanssa.

Kolme teknistä läpimurtoa

DeepSeek V4:ssä ei ole kyse pelkästä parametrien kasaamisesta. Malli esittelee kolme uutta arkkitehtuuriratkaisua. Manifold-Constrained Hyper-Connections vakauttaa koulutusprosessia biljoonan parametrin mittakaavassa, Engram Conditional Memory tehostaa tiedonhakua miljoonan tokenin kontekstista ja Lightning Indexer nopeuttaa pitkien syötteiden käsittelyä harvalla attention-mekanismilla.

Sisäisissä vertailuissa V4 pärjää koodaustehtävissä lähes Claude Opus 4.6:n ja GPT-5:n tasolla, ja monikielisyydessä se ohittaa molemmat. Hintaero on dramaattinen: DeepSeek V4 on arvioiden mukaan noin 50 kertaa edullisempi syötetokeneissa kuin Claude Opus. Riippumattomia vertailutuloksia ei kuitenkaan ole vielä vahvistettu.

Vientirajoitukset eivät pysäyttäneet

DeepSeek V4 on konkreettisin osoitus siitä, että Yhdysvaltain vientirajoitukset eivät ole pysäyttäneet Kiinan tekoälykehitystä. Trumpin hallinto on kiristänyt valvontaa merkittävästi: Entity Listille on lisätty kymmeniä kiinalaisia toimijoita, Nvidian H20-piirin vienti Kiinaan vaatii erillistä lupaa, ja Yhdysvallat on julistanut Huawein Ascend-sirujen käytön missä tahansa maailmassa amerikkalaisten vientisäädösten vastaiseksi.

DeepSeekin vastaus on ollut strateginen. Helmikuun lopussa uutisoitiin, että yhtiö esti Nvidian ja AMD:n pääsyn V4:n esijulkaisuversioon. Tämä rikkoi alan vakiintuneen käytännön, jossa sirunvalmistajat optimoivat tuotteensa uusille malleille etukäteen. Samaan aikaan Huawein Ascend-yksikkö sai viikkojen etumatkan V4:n arkkitehtuurin optimointiin.

Viesti on selvä. DeepSeek rakentaa rinnakkaista tekoälyekosysteemiä, joka ei ole riippuvainen amerikkalaisesta laitteistosta. Sirusota ei ole enää pelkästään siruista vaan ohjelmistoekosysteemien hallinnasta.

Avoin lähdekoodi kiristää kilpailua

V4 julkaistiin Apache 2.0 -lisenssillä, joten kuka tahansa voi käyttää, muokata ja jakaa mallia kaupallisesti. Se kilpailee suoraan Metan Llama-mallien ja Alibaban Qwen-sarjan kanssa avoimen lähdekoodin tekoälyn kärkipaikasta.

Suomalaisille yrityksille ja tutkijoille kehitys avaa uusia mahdollisuuksia. Avoimen mallin käyttö ei vaadi suuria API-budjetteja, ja sitä voi ajaa omilla palvelimilla ilman toimittajalukkoa. Sitran johtava asiantuntija Tarmo Toikkanen on kuitenkin kehottanut varovaisuuteen: DeepSeekin menestys osoittaa, ettei tekoälykehitys vaadi rajattomia resursseja, mutta kiinalaisten palveluntarjoajien läheinen suhde valtioon pakottaa pohtimaan, mihin käyttäjien data päätyy.

Silo AI:n perustaja Peter Sarlin on aiemmin arvioinut DeepSeekin mallien merkittävimmän piirteen olevan niiden energiatehokkuus. V4 vie ajatusta pidemmälle: se osoittaa, että tehokkuusinnovaatiot voivat kompensoida laitteiston rajoitteita.

1 biljoona↑

Kokonaisparametrit

32 mrd

Aktiiviset per päättely

1 milj.+↑

Konteksti-ikkuna (tokenia)

~50×↑

Edullisempi kuin Claude Opus

QverLabs, Awesome Agents, 2026

Sanasto

Mixture-of-Experts (MoE)
Tekoälyarkkitehtuuri, jossa malli koostuu useista erikoistuneista osamalleista eli "asiantuntijoista". Kutakin syötettä käsittelee vain pieni osa niistä, mikä pitää laskentakustannukset kurissa vaikka mallin kokonaiskapasiteetti on valtava.
Tokeni
Tekstin perusyksikkö, jonka kielimalli käsittelee. Yksi tokeni on suomeksi noin puoli sanaa. Miljoonan tokenin konteksti-ikkuna tarkoittaa, että malli voi käsitellä kerralla noin 500 000 suomenkielistä sanaa.
Multimodaalinen
Kyky käsitellä useita tietomuotoja – tekstiä, kuvia, videota ja ääntä – samassa mallissa sen sijaan, että jokaista varten tarvittaisiin erillinen järjestelmä.

Strateginen signaali

Yhdysvaltain vientirajoitusstrategia on perustunut oletukseen, että huippuluokan tekoäly vaatii huippuluokan siruja. DeepSeek V4 haastaa tämän oletuksen. Jos biljoonan parametrin malli toimii riittävän hyvin kotimaisilla siruilla, rajoitusten teho muuttuu kyseenalaiseksi.

DeepSeekin vertailuarvot ovat lupaavia mutta vahvistamattomia, ja kiinalaisten tekoälymallien itsenäinen arviointi on osoittautunut hitaaksi. V4:n todellinen suorituskyky selviää vasta riippumattomien testien myötä. Euroopan kannalta olennaisinta on kuitenkin se, mitä malli kertoo tekoälyn geopolitiikasta: teknologinen omavaraistuminen etenee Kiinassa nopeammin kuin Washington oletti.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.