Tekoäly

Kiinan tekoäly maksaa murto-osan lännen hinnasta

DeepSeekin uusi malli on käytössä yli 70 kertaa halvempi kuin Anthropicin Fable 5.

Nelli NelisanomaNelli Nelisanoma
Jaa:
Kiinan tekoäly maksaa murto-osan lännen hinnasta
Kuva: N509FZ / CC BY-SA 4.0

DeepSeek veloittaa uudesta V4-Flash-mallistaan 0,14 dollaria miljoonalta syötetokenilta. Anthropicin Fable 5 ottaa samasta työstä 10 dollaria. Vastaustokeneissa ero on vielä jyrkempi: 0,28 dollaria vastaan 50 dollaria.

Tavallisessa työkuormassa, jossa syötettä kuluu moninkertaisesti vastauksiin nähden, yhdistetty lasku venyy noin satakertaiseksi. Se ei ole hinnoitteluvirhe eikä kampanjatarjous, vaan lähtökohta, jolla kolme kiinalaista tekoäly-yhtiötä tuli markkinoille kahden viikon sisällä.

Alibaba julkaisi Qwen 3.8-Maxin ja avasi sen painot ensimmäistä kertaa. Moonshot AI toi markkinoille Kimi K3:n. DeepSeek täydensi V4-perheensä kompaktilla Flash-versiolla. Jokaisen hinnasto alittaa länsimaiset kilpailijat selvästi.

71×

Syötetokenien hintaero V4-Flashin ja Fable 5:n välillä

179×

Vastaustokenien hintaero samojen mallien välillä

6/10

OpenRouterin käytetyimmistä malleista kiinalaisia

Yhtiöiden hinnastot ja OpenRouter, elokuu 2026

Mikä token oikeastaan on?

Token on tekstinpala, jonka kielimalli käsittelee kerrallaan. Englannissa yksi token vastaa karkeasti neljää merkkiä eli noin kolmea neljäsosaa sanasta, joten miljoona tokenia on runsaat 700 000 sanaa. Suomi on tokenisaattoreille kalliimpi kieli: pitkät yhdyssanat ja sijamuodot pilkkoutuvat useaksi tokeniksi, joten sama asiasisältö maksaa suomeksi tyypillisesti enemmän kuin englanniksi. Laskutus tapahtuu erikseen syötteestä eli siitä, mitä mallille annetaan, ja vastauksesta eli siitä, mitä se tuottaa.

Kymmenen dollaria vai tuhat

Ajatellaan suomalaista ohjelmistoyritystä, joka ajaa mallia tuotannossa. Asiakaspalvelun esikäsittely, dokumenttien luokittelu tai koodiavustaja kuluttaa keskikokoisessa käytössä helposti 50 miljoonaa syötetokenia ja 10 miljoonaa vastaustokenia kuukaudessa.

DeepSeek V4-Flashilla lasku on noin kymmenen dollaria kuukaudessa. Fable 5:llä täsmälleen sama työkuorma maksaa tuhat. Yhdellä kehittäjätunnilla ei kuiteta eroa, joka toistuu joka kuukausi.

Prototyypissä ero ei tunnu, koska kuukausilasku on kummallakin muutamia kymmeniä euroja. Se tuntuu siinä vaiheessa, kun ominaisuus avataan kaikille asiakkaille ja volyymi satakertaistuu. Juuri siinä kohdassa moni suomalainen tiimi joutuu nyt perustelemaan hallitukselle, miksi käytössä on kalliimpi vaihtoehto.

Halpa ei tarkoita huonoa

Hintaero olisi merkityksetön, jos mallit jäisivät selvästi jälkeen suorituskyvyssä. Artificial Analysisin älykkyysvertailussa Qwen 3.8-Max yltää Claude Sonnet 5:n tasolle, ja DeepSeek V4-Flash jää yhden pisteen päähän OpenAI:n GPT-5.6 Lunasta. Ratkaistua tehtävää kohti V4-Flash tulee noin 40 prosenttia halvemmaksi kuin Luna, kolme senttiä viiden sijaan.

Kehittäjien valinnat näkyvät jo käyttötilastoissa. Kiinalaismallit pitävät hallussaan kuutta paikkaa OpenRouterin kymmenen käytetyimmän mallin listalla. OpenRouter on välityspalvelu, jonka kautta suuri osa pienistä ja keskisuurista kehitystiimeistä kokeilee malleja ennen sitoutumista, joten listan kärki kertoo melko suoraan, mihin arkinen kehitystyö nojaa.

Tekniikka selittää osan hinnasta. V4-Flashissa on 284 miljardia parametria, ja se päihittää DeepSeekin oman 1,6 biljoonan parametrin V4 Pron vertailutesteissä lähes 14 prosentilla. FP4-tarkkuudella malli mahtuu noin 142 gigatavuun näytönohjainmuistia, eli yhteen palvelimeen. Qwen 3.8-Max puolestaan on 2,4 biljoonan parametrin sekamalli miljoonan tokenin konteksti-ikkunalla, ja Alibaba lupaa siitä myös 27 miljardin parametrin version.

Ne hallitsevat selvästi avoimia malleja juuri nyt, enkä yllättyisi, jos ne alkavat hallita myös huippupäätä joko tämän vuoden loppuun mennessä tai ensi vuonna, tällä kehitysvauhdilla.

Clément Delangue, Hugging Facen toimitusjohtaja

Mitä halpuus ei ratkaise

Hinta on vain toinen puoli laskelmaa. Kun suomalainen yritys kutsuu DeepSeekin tai Alibaban rajapintaa, syöte lähtee kiinalaisen yhtiön palvelimille ja kiinalaisen lainsäädännön piiriin. Jos mukana on asiakastietoja, potilastietoja tai liikesalaisuuksia, GDPR:n siirtosäännökset eivät katoa mihinkään sillä perusteella, että tokeni maksaa sentin murto-osan.

Avoimet painot muuttavat tämän asetelman. V4-Flashin kokoinen malli pyörii yhdellä palvelimella, joten sen voi ajaa suomalaisessa konesalissa ilman että data poistuu talosta. Silloin hintavertailukin muuttuu: rajapintamaksun tilalle tulevat laiteinvestointi ja ylläpito, mutta tietosuojakysymys ratkeaa kertaheitolla.

Mallin alkuperä on eri kysymys kuin se, missä sitä ajetaan. Koulutusaineistoa ei ole julkaistu, ja kiinalaismallien tiedetään kiertävän tiettyjä poliittisia aiheita. Uutistiivistelmässä se ei haittaa, mutta jos mallia käytetään sisällön moderointiin tai riskiarvioihin, painotukset kannattaa testata itse eikä olettaa neutraaleiksi.

Anthropicin toimitusjohtaja Dario Amodei on sanonut vastustavansa nimenomaan avoimia malleja, jotka on tehty Kiinassa, tislattu suljetuista malleista tai jotka eivät täytä tiukkoja turvallisuusmittareita. Argumentti on kiistanalainen jo siksi, että kerran julkaistuja painoja ei saa takaisin. Kun malli on levinnyt verkkoon, sen käyttöä ei enää säädellä lisenssiehdoilla.

Sanasto

Avoimet painot
Mallin painot ovat sen koulutuksessa opitut lukuarvot, joihin kaikki mallin osaaminen on tallennettu. Kun painot julkaistaan avoimesti, kuka tahansa voi ladata mallin ja ajaa sitä omalla palvelimellaan ilman yhteyttä valmistajan palveluun.
Konteksti-ikkuna
Tekstimäärä, jonka malli pystyy pitämään kerralla muistissaan. Miljoonan tokenin ikkunaan mahtuu karkeasti muutaman paksun kirjan verran tekstiä, ja sen ylittävä osa unohtuu.
Sekamalli
Malli, joka on jaettu useaan erikoistuneeseen osaan, joista vain pieni osa herää käyttöön kutakin kysymystä varten. Siksi biljoonien parametrien malli voi olla ajaa halvempi kuin kokonsa perusteella luulisi.

Kiinnostavin luku ei lopulta ole 0,14 dollaria vaan se, mitä sillä aletaan tehdä. Kun päättely maksaa käytännössä nollan, kannattaviksi muuttuvat sovellukset, joita kukaan ei ole rakentanut, koska laskuri kävisi liian nopeasti: jokaisen saapuvan sähköpostin lukeminen, jokaisen lokirivin selittäminen, jokaisen koodimuutoksen tarkastaminen kolmeen kertaan.

Hintaromahdus ei siis siirrä vain budjettia yhdeltä mallintarjoajalta toiselle. Se siirtää rajaa sen välillä, mikä on liian kallista automatisoida ja mikä ei, ja se raja liikkuu nyt nopeammin kuin useimpien yritysten hankintaprosessit ehtivät perässä.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.