Pysyvä alennus paljastaa kilpailutilanteen
DeepSeek ilmoitti maanantaina tekevänsä V4-Pro-mallin 75 prosentin alennuksesta pysyvän. Kiinalainen startup oli aiemmin esittänyt alennusta toukokuun lopussa raukeavana kampanjana. Päätös vahvistettiin samaan aikaan kun Huawein Ascend 950 -piirien toimitusvolyymit alkavat näkyä yrityksen laskentakapasiteetissa.
Hinnoittelu liikkuu nyt 0,0035 ja 0,87 dollarin välillä miljoonalta tokenilta käyttötavasta riippuen. Halvin hinta koskee välimuistista palautettavia syötetokeneita, kallein tulostokeneita.
29-kertainen ero länsimaisiin malleihin
Vertailu paljastaa eron. Anthropicin Claude Opus 4.7:n tulostokenit maksavat 25 dollaria miljoonalta. OpenAI:n GPT-5.5 nostaa hinnan 30 dollariin. Googlen Gemini 2.5 Pro asettuu 12 dollariin. DeepSeek pyytää alle dollarin.
Sovellus joka tuottaa sata miljoonaa tulostokenia kuukaudessa maksaisi V4-Prossa noin 87 dollaria. Claude Opus 4.7 -mallissa sama työ kustantaisi 2 500 dollaria, GPT-5.5:ssä 3 000 dollaria. Ero on niin suuri, että se vaikuttaa siihen, millaisia tekoälysovelluksia ylipäätään kannattaa rakentaa.
Pysyvä alennus V4-Pro-mallista
Hinta per miljoona tulostokenia
Ero GPT-5.5:n tulostokenihintaan
Huawein piiri, jonka vientikielto piti estää
Huawein piiri on hinnan moottori
Hinnanlasku ei perustu hävikkimyyntiin. Huawein Ascend 950PR -piiri lanseerattiin alkuvuodesta 2026, ja sen tehollinen suorituskyky on 1,56 petaflopsia FP8-tarkkuudella. Mukana on 128 gigatavua omaa HBM-muistia. Tämä on ensimmäinen kerta kun kiinalainen valmistaja tekee korkean kaistanleveyden muistinsa itse, sillä aiemmin SK Hynix, Micron ja Samsung hallitsivat markkinaa.
Huawei tähtää 750 000 piirin toimitusmäärään vuonna 2026. Loppuvuodesta julkaistava 950DT-versio nostaa muistikapasiteetin 144 gigatavuun ja kaistanleveyden 4 teratavuun sekunnissa. Kahden version yhteisvolyymi tuottaa riittävän tarjonnan, jotta DeepSeekin kaltaiset suuret asiakkaat voivat hinnoitella aggressiivisesti.
Vientikielto kääntyi itseään vastaan
Yhdysvaltain kauppaministeriö rakensi Nvidian H100- ja A100-piirien vientikiellon Kiinaan ohjatakseen tekoälyn kärkimallien koulutusta länsimaisiin yrityksiin. Strategia perustui oletukseen, että pelkkä laskentateho ratkaisee.
Lopputulos näkyy nyt hinnoittelussa. Kun Huawei joutui rakentamaan oman piiripinonsa SMIC-yhtiön valmistuskapasiteetin varaan, syntyi rinnakkainen tuotantoketju. Sen kustannustaso on alempi ja toimitusvarmuus suurempi kuin Nvidian Aasian-toimituksissa, joissa Washington voi muuttaa lupakäytäntöjä lyhyellä varoitusajalla. Vientikielto tarkoitti, että kiinalaisilla ei ollut muuta vaihtoehtoa kuin tehdä halvempaa rautaa itse.
Suomalaisille pankeille hankala kysymys
Suomalaisille pankeille tilanne synnyttää ristiriidan. OP ja Nordea käyttävät tekoälyä asiakaspalvelussa, asiakirjojen luokittelussa ja petoksentorjunnassa. Halvempi malli leikkaa kustannuksia merkittävästi: jos kuukausittaiset tokenikulut ovat satatuhansia euroja, 25-kertainen hintaero ei jää huomaamatta talousjohdolta.



