Tekoäly

DeepSeek romautti hinnat 75 prosenttia – kiitos Huawein

V4-Pron tokeni maksaa nyt murto-osan Claude Opuksen ja GPT-5.5:n hinnasta.

Kaisa KasvukoskiKaisa Kasvukoski
Jaa:
DeepSeek romautti hinnat 75 prosenttia – kiitos Huawein
Kuva: X-SHLIED / CC BY-SA 4.0

Pysyvä alennus paljastaa kilpailutilanteen

DeepSeek ilmoitti maanantaina tekevänsä V4-Pro-mallin 75 prosentin alennuksesta pysyvän. Kiinalainen startup oli aiemmin esittänyt alennusta toukokuun lopussa raukeavana kampanjana. Päätös vahvistettiin samaan aikaan kun Huawein Ascend 950 -piirien toimitusvolyymit alkavat näkyä yrityksen laskentakapasiteetissa.

Hinnoittelu liikkuu nyt 0,0035 ja 0,87 dollarin välillä miljoonalta tokenilta käyttötavasta riippuen. Halvin hinta koskee välimuistista palautettavia syötetokeneita, kallein tulostokeneita.

29-kertainen ero länsimaisiin malleihin

Vertailu paljastaa eron. Anthropicin Claude Opus 4.7:n tulostokenit maksavat 25 dollaria miljoonalta. OpenAI:n GPT-5.5 nostaa hinnan 30 dollariin. Googlen Gemini 2.5 Pro asettuu 12 dollariin. DeepSeek pyytää alle dollarin.

Sovellus joka tuottaa sata miljoonaa tulostokenia kuukaudessa maksaisi V4-Prossa noin 87 dollaria. Claude Opus 4.7 -mallissa sama työ kustantaisi 2 500 dollaria, GPT-5.5:ssä 3 000 dollaria. Ero on niin suuri, että se vaikuttaa siihen, millaisia tekoälysovelluksia ylipäätään kannattaa rakentaa.

75 %↓

Pysyvä alennus V4-Pro-mallista

0,87 $

Hinta per miljoona tulostokenia

34×

Ero GPT-5.5:n tulostokenihintaan

Ascend 950↑

Huawein piiri, jonka vientikielto piti estää

Technology.org ja TrendForce, toukokuu 2026

Huawein piiri on hinnan moottori

Hinnanlasku ei perustu hävikkimyyntiin. Huawein Ascend 950PR -piiri lanseerattiin alkuvuodesta 2026, ja sen tehollinen suorituskyky on 1,56 petaflopsia FP8-tarkkuudella. Mukana on 128 gigatavua omaa HBM-muistia. Tämä on ensimmäinen kerta kun kiinalainen valmistaja tekee korkean kaistanleveyden muistinsa itse, sillä aiemmin SK Hynix, Micron ja Samsung hallitsivat markkinaa.

Huawei tähtää 750 000 piirin toimitusmäärään vuonna 2026. Loppuvuodesta julkaistava 950DT-versio nostaa muistikapasiteetin 144 gigatavuun ja kaistanleveyden 4 teratavuun sekunnissa. Kahden version yhteisvolyymi tuottaa riittävän tarjonnan, jotta DeepSeekin kaltaiset suuret asiakkaat voivat hinnoitella aggressiivisesti.

Vientikielto kääntyi itseään vastaan

Yhdysvaltain kauppaministeriö rakensi Nvidian H100- ja A100-piirien vientikiellon Kiinaan ohjatakseen tekoälyn kärkimallien koulutusta länsimaisiin yrityksiin. Strategia perustui oletukseen, että pelkkä laskentateho ratkaisee.

Lopputulos näkyy nyt hinnoittelussa. Kun Huawei joutui rakentamaan oman piiripinonsa SMIC-yhtiön valmistuskapasiteetin varaan, syntyi rinnakkainen tuotantoketju. Sen kustannustaso on alempi ja toimitusvarmuus suurempi kuin Nvidian Aasian-toimituksissa, joissa Washington voi muuttaa lupakäytäntöjä lyhyellä varoitusajalla. Vientikielto tarkoitti, että kiinalaisilla ei ollut muuta vaihtoehtoa kuin tehdä halvempaa rautaa itse.

Suomalaisille pankeille hankala kysymys

Suomalaisille pankeille tilanne synnyttää ristiriidan. OP ja Nordea käyttävät tekoälyä asiakaspalvelussa, asiakirjojen luokittelussa ja petoksentorjunnassa. Halvempi malli leikkaa kustannuksia merkittävästi: jos kuukausittaiset tokenikulut ovat satatuhansia euroja, 25-kertainen hintaero ei jää huomaamatta talousjohdolta.

Sääntelyn este on kova

Finanssivalvonta edellyttää, että pankkien käyttämät palvelut kestävät GDPR:n ja EU AI Actin vaatimukset. DeepSeekin tietojen siirtyminen Kiinaan altistaisi pankit Kiinan kansallisen turvallisuuslainsäädännön piiriin, mikä FIVAn nykyisen tulkinnan valossa estää käytön asiakasdatassa. Avoimet painot voi kuitenkin ajaa eurooppalaisessa pilvessä.

Sanasto

Token
Tekstin perusyksikkö jota kielimalli käsittelee. Yksi token vastaa karkeasti puolta suomenkielistä sanaa, joten miljoona tokenia on noin puoli miljoonaa sanaa.
FP8-tarkkuus
Laskentatapa jossa luvut tallennetaan kahdeksalla bitillä. Pienempi tarkkuus kuluttaa vähemmän muistia ja energiaa, mikä nopeuttaa tekoälymallien laskentaa.
HBM-muisti (High Bandwidth Memory)
Korkean kaistanleveyden muisti – erikoistunut nopea muistityyppi, jota tekoälypiirit tarvitsevat syöttääkseen dataa laskentayksiköille riittävän nopeasti.

Aalto-yliopiston tutkimusryhmissä rajoitukset ovat löyhempiä, mutta vastaavia rajaviivoja vedetään jo siellä. Tampereen yliopisto ja Helsingin kaupunki ovat kieltäneet DeepSeekin käytön omilla laitteillaan tietoturvasyistä, ja monet korkeakoulut tarkastelevat omia datapolitiikkojaan.

Mallien ympärille rakennettavat välikerrokset

Hintaero pakottaa eurooppalaiset yritykset uudenlaiseen arkkitehtuuriin. Suora kytkös kiinalaiseen mallirajapintaan on harvalle mahdollinen, mutta yhä useampi konepajayritys, logistiikkatoimija ja vakuutusyhtiö katsoo malleja, jotka pyörivät eurooppalaisessa pilvessä mutta ovat avointa lähdekoodia.

DeepSeek julkaisee mallinsa painot edelleen avoimesti, mikä mahdollistaa niiden ajamisen Hetznerin, OVH:n tai paikallisen palveluntarjoajan rautaan. Sirun saatavuus on toinen kysymys: Euroopassa Nvidian H100-pohjaiset palvelimet maksavat enemmän kuin DeepSeekin oma palvelu. Hintaetu kapenee, mutta datan sijainti pysyy hallinnassa.

Suvereniteetin hinta nousee kysymykseksi, johon on kahdenlaisia vastauksia. Joko Eurooppa hyväksyy, että sen tekoälyinfrastruktuuri jää kalliimmaksi mutta sääntelyn alaiseksi, tai se rakentaa oman piiri- ja mallipinonsa. Sitran ja Business Finlandin tämänkeväiset raportit pitävät jälkimmäistä realistisena vain, jos Suomi sitoutuu osaksi yhteiseurooppalaista hankerahoitusta. Yksin investointi ei kanna.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 420 vuotta koodaamatta, sitten 5,4 miljoonaa
  5. 5Datakeskukset Suomessa – hankkeet, sähkö ja vero

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.