Koneoppiminen

Uusi Claude on kymmenen kertaa halvempi – tietyin ehdoin

Haiku 5.5 on halpa vain lyhyissä tehtävissä, ja keskimääräinen säästö jää 75 prosenttiin.

Aino AikajärviAino Aikajärvi
Jaa:
Uusi Claude on kymmenen kertaa halvempi – tietyin ehdoin
Kuva: Mvolz / CC0

Yashodha Bhavnani vastaa pilvitallennusyhtiö Boxin tekoälytuotteista. Hän on testannut Anthropicin uutta pientä kielimallia jo ennen julkaisua. Boxin testeissä malli päihitti edeltäjänsä selvästi ja vastasi noin kaksi kertaa nopeammin, ja yhtiö harkitsee sitä analyyttiseen työhön suuressa mittakaavassa.

“Varhaisissa testeissä Claude Haiku 5.5 sai 11 pistettä enemmän kuin Haiku 4.5, noin puolella viiveestä.”

— Yashodha Bhavnani, Boxin tekoälytuotteiden varatoimitusjohtaja Anthropicin julkaisutiedotteessa (alkukieli englanti)

Anthropic julkaisi Claude Haiku 5.5:n 7. lokakuuta. Haiku on yhtiön pienin ja halvin mallisarja. Isompi Sonnet ja suurin Opus päättelevät paremmin, mutta ne maksavat moninkertaisesti. Uutuuden tärkein myyntivaltti on hinta. Malli on saatavilla Clauden API:n kautta sekä AWS:n, Google Cloudin ja Microsoft Azuren palveluissa.

Kymmenesosa vai neljännes?

Kun kehote on alle 100 000 tokenia, syöte maksaa 0,10 dollaria ja mallin tuottama teksti 0,50 dollaria miljoonalta tokenilta. Haiku 4.5:llä vastaavat hinnat ovat 1 ja 5 dollaria, joten tokenihinta putoaa 90 prosenttia. Token on tekstin pala, jonka malli käsittelee kerralla. Englanninkielisessä tekstissä sanaa kohti kuluu keskimäärin vähän yli yksi token.

Anthropic itse lupaa silti vain noin 75 prosentin säästön. Eroon on kaksi syytä. Uusi malli käyttää päivitettyä tokenisaattoria, joka pilkkoo saman tekstin hieman useampaan tokeniin kuin Haiku 4.5. Yli 100 000 tokenin kehotteista veloitetaan lisäksi 0,50 ja 2,50 dollaria, mikä on vain puolet edeltäjän hinnasta. Yhtiö kertoo 75 prosentin olevan keskiarvio, jossa molemmat tekijät on otettu huomioon.

Halvempaan hintaluokkaan osuu paljon liikennettä. Anthropicin mukaan noin 90 prosenttia edelliselle Haikulle lähetetyistä pyynnöistä jäi 100 000 tokenin rajan alle.

Mitä 100 000 tokenin raja tarkoittaa?

Raja koskee yksittäisen pyynnön koko syötettä, myös välimuistista luettua osaa. Jos kehote ylittää rajan, koko pyyntö laskutetaan kalliimman hintaluokan mukaan. Englanniksi 100 000 tokenia on karkeasti 75 000 sanaa. Tavallinen asiakaspalvelukysymys tai sähköpostin luokittelu jää reilusti rajan alle, mutta pitkät sopimukset, kokonaiset koodikannat ja pitkään jatkuneet agenttiajot voivat ylittää sen.

447 €

Asiakaspalvelubotti Haiku 4.5:llä, 100 000 viestiä kuussa

45 €↓

Samat tokenimäärät Haiku 5.5:llä

n. 58 €↓

Haiku 5.5, kun uuden tokenisaattorin noin 30 % lisä huomioidaan

AI Suomen laskelma Anthropicin hinnaston ja EKP:n kurssin pohjalta

Sanasto

Konteksti-ikkuna
Tekstimäärä, jonka kielimalli pystyy ottamaan huomioon yhdellä kertaa: ohjeet, liitetyt asiakirjat, keskusteluhistoria ja vastaus yhteensä. Se mitataan tokeneina.
Välimuisti (kehotteen)
Toistuvasti lähetettävä osa kehotteesta, esimerkiksi samat ohjeet joka pyynnössä, tallennetaan hetkeksi, jolloin sen uudelleenkäyttö on nopeampaa ja halvempaa.
Eräajo
Tapa lähettää suuri joukko pyyntöjä kerralla käsiteltäväksi myöhemmin, esimerkiksi vuorokauden kuluessa. Vastaukset tulevat viiveellä, mutta hinta on alempi.

Mihin halpa malli kelpaa

Anthropic suosittelee Haikua tarkasti rajattuihin tehtäviin, joita tehdään paljon. Tällaisia ovat esimerkiksi tiivistelmät, luokittelu, tietokantahaut ja isomman mallin apulaisena toimiminen. Nopeutensa vuoksi malli sopii yhtiön mukaan myös reaaliaikaiseen asiakaspalveluun ja verkkoselaimen käyttöön. Haiku 5.5 on ensimmäinen Haiku, jonka päättelyn määrää voi säätää: kevyempi päättely tekee vastauksesta halvemman ja nopeamman.

Talousdataa käsittelevässä Rogossa malli kaivaa lukuja yhtiöiden 10-K-vuosiraporteista. ”Se on niin tarkka, että luottaisimme siihen siinä tehtävässä, ja niin nopea ja halpa, että voimme ajaa sitä paljon”, sanoo Rogon soveltavan tekoälyn tiimissä työskentelevä Alex Wang Anthropicin tiedotteessa. Sitaatti on käännetty englannista.

Vaativaan ohjelmointiin Haiku ei ole paras valinta. Anthropic myöntää sen itsekin ja suosittelee monimutkaiseen koodaukseen Sonnet 5.5:tä tai Opus 5.5:tä. Yhtiön omissa vertailuissa Haiku 5.5 sai Terminal-Bench 4.0 -testistä 39,2 prosenttia, kun Sonnet 5.5 ylsi 70,6 prosenttiin. Edeltäjään verrattuna parannus on kuitenkin suuri. Tietokoneen käyttöä mittaavassa OSWorld 2.1 -testissä tulos nousi 15,7 prosentista 72,4 prosenttiin. Kaikki luvut ovat Anthropicin omia.

Asiakaspalvelubotti alle 60 eurolla kuussa

Otetaan esimerkiksi verkkokauppa, jonka asiakaspalvelubotti käsittelee 100 000 viestiä kuukaudessa. Jokaiseen pyyntöön sisältyvät ohjeet, tuotetiedot ja keskusteluhistoria, yhteensä noin 3 000 tokenia, ja vastauksen pituus on noin 400 tokenia. Haiku 4.5:llä lasku on 500 dollaria eli noin 447 euroa kuussa. Haiku 5.5:llä samat tokenimäärät maksavat 50 dollaria, noin 45 euroa.

Todellinen summa on hieman suurempi. Anthropicin dokumentaation mukaan yhtiön uudempi tokenisaattori tuottaa samasta tekstistä noin 30 prosenttia enemmän tokeneita kuin vanha. Jos tämä pätee myös Haikuun, kuukausilasku on noin 58 euroa. Suomenkielinen teksti kuluttaa yleensä enemmän tokeneita kuin englanti, joten oma mittaus omalla aineistolla kannattaa.

Pk-yritykselle tärkein muutos on se, että tekoälyä voi käyttää laajemmin. Kun yksi pyyntö maksaa murto-osan sentistä, saapuvien sähköpostien luokittelu, puhelujen tiivistäminen tai laskujen tarkistaminen ei enää kaadu kustannuksiin. Kiireettömät ajot voi lähettää eräajona puoleen hintaan, jolloin syöte maksaa 0,05 ja tuloste 0,25 dollaria miljoonalta tokenilta.

Suomi ja kilpailijat

Anthropicin tiedotteessa ei kerrota mallin kielitaidosta mitään. Yhtiön dokumentaatiossa kielikohtaiset luvut löytyvät vain Haiku 4.5:lle, eikä suomi ole mukana niissäkään. AI Suomi ei ole vielä testannut Haiku 5.5:n suomen kielen taitoa. Ennen kuin malli pannaan palvelemaan suomalaisia asiakkaita, sitä kannattaa koetella omalla aineistolla, myös taivutusten ja yhdyssanojen osalta.

Hinta on asetettu tarkasti kilpailijan mukaan. OpenAI:n GPT-6 Luna maksaa täsmälleen saman verran, 0,10 ja 0,50 dollaria miljoonalta tokenilta, kun syöte on alle 272 000 tokenia. Anthropicin omassa vertailussa Haiku 5.5 oli Lunaa parempi jokaisessa testissä, jossa molemmat olivat mukana. Googlen Gemini 3.1 Flash-Lite maksaa 0,25 ja 1,50 dollaria. Halvimpia malleja ovat yhä vanhemmat pienmallit, kuten OpenAI:n gpt-5-nano, jonka hinnat ovat 0,05 ja 0,40 dollaria.

Kehittäjän kannalta olennaisinta on hinnoittelun rakenne. Muut Anthropicin uudet mallit laskuttavat koko miljoonan tokenin konteksti-ikkunasta saman hinnan. Haiku 5.5 on poikkeus, jossa pitkä kehote maksaa tokenia kohti viisinkertaisesti. Kehotteen pituutta kannattaa siksi seurata yhtä tarkasti kuin mallin valintaa: yksi liian pitkäksi kasvanut keskusteluhistoria voi viisinkertaistaa pyynnön tokenihinnan.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 420 vuotta koodaamatta, sitten 5,4 miljoonaa
  5. 5Datakeskukset Suomessa – hankkeet, sähkö ja vero

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.