DeepSeek otti käyttöön ruuhkahinnoittelun, ja Suomen aamupäivä on ruuhkaa.
Kiinalainen DeepSeek on rakentanut maineensa sillä, että se myy tekoälyä murto-osalla amerikkalaisten kilpailijoiden hinnasta. Tänään 17. elokuuta yhtiö teki päinvastoin: se nosti API-hintojaan 50–1100 prosenttia mallista, tokenityypistä ja kellonajasta riippuen.
Samalla vahvistui se, mikä oli tiedetty epävirallisesti muutaman päivän. V4 Pro on olemassa ja se on myynnissä. Malli ilmestyi hinnastoon elokuun puolivälissä ilman tiedotetta, ja kuten AI Suomi aiemmin kertoi, maininta katosi yhtiön sivuilta tuntien sisällä. Nyt V4 Pro ja kevyempi V4 Flash ovat virallisesti DeepSeekin ainoat API-mallit.
Käänteen ydin on yksinkertainen. V4 Pron ulostulotokenit maksoivat 0,87 dollaria miljoonalta. Ruuhka-aikaan sama miljoona maksaa nyt 3,96 dollaria eli 4,6-kertaisen summan. Hiljaisena aikana hinta on 1,98 dollaria, mikä on yhä yli kaksinkertainen vanhaan verrattuna.
Halvempi V4 Flash pysyy edullisena: ulostulotokenit 0,66 dollaria hiljaisena aikana ja 1,32 ruuhkassa, syötetokenit vastaavasti 0,22 ja 0,44. Molemmissa malleissa konteksti-ikkuna on miljoona tokenia ja enimmäisulostulo 384 000 tokenia.
V4 Pro vastaan V4 Flash – sama konteksti, kolminkertainen hinta
DeepSeek V4 Pro
Yhtiön tehokkain malli, jonka hinta nousi eniten
- Ulostulotokenit, ruuhka-aika
- 3,96 $ / 1M
- Ulostulotokenit, hiljainen aika
- 1,98 $ / 1M
- Syötetokenit, ruuhka / hiljainen
- 1,32 $ / 0,66 $ / 1M
- Konteksti-ikkuna ja enimmäisulostulo
- 1 000 000 / 384 000 tokenia
DeepSeek V4 Flash
Kevyempi malli, joka pysyi edullisena
- Ulostulotokenit, ruuhka-aika
- 1,32 $ / 1M
- Ulostulotokenit, hiljainen aika
- 0,66 $ / 1M
- Syötetokenit, ruuhka / hiljainen
- 0,44 $ / 0,22 $ / 1M
- Konteksti-ikkuna ja enimmäisulostulo
- 1 000 000 / 384 000 tokenia
DeepSeekin API-hinnasto 17.8.2026
Ruuhka-aika osuu suomalaiseen aamupäivään
Uusi hinnoittelu jakaa vuorokauden kahteen. Ruuhkatunteja ovat kello 01–04 ja 06–10 UTC-ajassa, kaikki muu on hiljaista aikaa. Hiljaisen ajan taksa on tasan puolet ruuhkahinnasta, joten kellonaika ratkaisee laskusta puolet.
Ikkunat on mitoitettu Kiinan työpäivän mukaan, mutta Suomeen ne osuvat kiusallisesti. Kesäaikaan ruuhka on täällä kello 4–7 ja 9–13. Suomalaisen kehittäjän tavallinen aamupäivä menee siis kokonaan kalliimmalla taksalla, ja halvemmaksi muuttuu vasta lounaan jälkeen.
Yöllä ajettaville eräajoille muutos on siedettävä, koska ne voi siirtää hiljaiseen ikkunaan ilman että kukaan huomaa. Interaktiiviselle käytölle se ei ole. Koodiavustajat, chat-käyttöliittymät ja asiakaspalvelubotit kuormittavat rajapintaa juuri niinä tunteina, jolloin taksa on korkeimmillaan.
Mitä yksi tehtävä maksaa
Otetaan tyypillinen koodiavustajan tehtävä: 50 000 syötetokenia ilman välimuistiosumaa ja 5 000 tuotettua tokenia. Vanhalla hinnalla se maksoi noin 2,6 senttiä. Hiljaisena aikana hinta on nyt 4,3 senttiä ja ruuhka-aikaan 8,6 senttiä. Tuhat tällaista tehtävää päivässä tarkoitti ennen noin 780 dollarin kuukausilaskua. Ruuhkatunteina ajettuna sama käyttö maksaa nyt noin 2 570 dollaria.
Haitarin molemmat päät
Korotushaitari 50–1100 prosenttia on poikkeuksellisen leveä, koska se kattaa kaksi mallia, kolme tokenityyppiä ja kaksi taksaa. Loivimmillaan korotus on V4 Pron syötetokeneissa hiljaisena aikana: 0,435 dollarista 0,66 dollariin, eli noin 52 prosenttia. Ulostulotokeneissa ruuhka-aikaan noustaan jo 355 prosenttiin.
Haitarin yläpää syntyy halvimmista tokenityypeistä, joissa sentin murto-osan lisäys näyttää prosenteissa moninkertaistumiselta mutta jää euromääräisesti pieneksi. Prosenttiluku kannattaa siis lukea aina yhdessä absoluuttisen hinnan kanssa.
Välimuisti on nyt aiempaa arvokkaampi. V4 Prolla välimuistista luettu syötetokeni maksaa ruuhka-aikaan 0,044 dollaria miljoonalta, kun tuoreen kontekstin lukeminen maksaa 1,32. Ero on 30-kertainen, joten kehotteiden rakentaminen välimuistiystävällisiksi tuottaa suoraan rahaa.
Sanasto
- Token
- Tekstin perusyksikkö, jonka kielimalli käsittelee ja jonka mukaan käyttö laskutetaan. Yksi token on suomeksi noin puoli sanaa.
- Syöte- ja ulostulotokenit
- Syötetokenit ovat tekstiä, jonka käyttäjä lähettää mallille, ulostulotokenit mallin tuottamaa vastausta. Vastaus on tyypillisesti selvästi kalliimpaa kuin syöte.
- Välimuistiosuma
- Kun sama teksti lähetetään mallille uudelleen, se voidaan lukea valmiiksi tallennetusta välimuistista murto-osalla hinnasta sen sijaan, että se käsiteltäisiin alusta.
Halpuuttajan rooli oli aina hinnoittelupäätös
DeepSeek on parin vuoden ajan toiminut alan painekattilan venttiilinä. R1:n julkaisu tammikuussa 2025 painoi hintoja koko markkinalla ja pakotti amerikkalaiset yhtiöt vastaamaan. Nyt sama toimija liikkuu toiseen suuntaan, eikä perusteluja ole kerrottu.
Tekninen selitys on tarjolla ilman että yhtiö sitä vahvistaa. Miljoonan tokenin konteksti-ikkuna ja 384 000 tokenin ulostulo ovat raskaita ajaa, ja laskentakapasiteetti on Kiinassa vientirajoitusten takia niukkaa. Ruuhkahinnoittelu on suora tapa siirtää kysyntää tunteihin, jolloin kortteja on vapaana. Malli on tuttu sähköpörssistä, ei tekoälystä.
Suomalaiselle yritykselle, joka on laskenut tuotteensa katteen DeepSeekin hintatason varaan, korotus on muistutus. Halvin rajapinta ei ole infrastruktuuria vaan hinnoittelupäätös, ja sen voi perua. Ilmoituksen ja voimaantulon välissä oli päiviä, ei kuukausia, eikä siirtymäaikaa ollut lainkaan.
Riippumattomat arviot V4 Pron suorituskyvystä ovat yhä ristiriitaisia, joten hinnankorotus tulee ennen kuin kukaan on ehtinyt varmistaa, mistä maksetaan. Sillä on seurauksensa myös länsimallien hinnoittelijoille: 3,96 dollaria miljoonalta ulostulotokenilta ei ole enää se luku, jolla kilpailijat pakotetaan liikkeelle, vaan hinta, jota vastaan voi kilpailla.
Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta.
Lue lisää toimintaperiaatteistamme.