Tekoäly

Opus 4.8 koodaa 69,2 % – fast-tila kolmasosaan hinnasta

Reaktorin, Futuricen ja Nitorin veloitusmalli joutuu uusiksi

Aino AikajärviAino Aikajärvi
Jaa:
Opus 4.8 koodaa 69,2 % – fast-tila kolmasosaan hinnasta
Kuva: TechCrunch / CC BY 2.0

Sama hinta, parempi tulos

Anthropic julkisti torstaina Claude Opus 4.8 -mallin. Agenttikoodauksen vakiotestissä uusi versio ylsi 69,2 prosenttiin, kun edeltäjä Opus 4.7 jäi 64,3 prosenttiin. Standardihinta säilyi ennallaan, mutta yhtiö painoi fast-tilan hinnan kolmasosaan aiemmasta tasosta.

Standardimallin syötetokeneista veloitetaan edelleen 5 dollaria miljoonalta ja tulostetokeneista 25 dollaria, eli täsmälleen 4.7:n hinnoittelu. Fast-tila eli nopeutettu päättely maksaa nyt 10 ja 50 dollaria, ja toimii Anthropicin mukaan 2,5-kertaisella nopeudella aiempaan polkuun verrattuna. Korkea päättelyteho on uusi oletus, mutta käyttäjä voi laskea sitä claude.ai:n ja Coworkin uudella säätimellä.

Opus 4.8 lyhyesti

Agenttikoodaus: 64,3 % → 69,2 %.

Standardihinta: 5 / 25 USD miljoonalta tokenilta (ennallaan).

Fast-tila: 10 / 50 USD miljoonalta tokenilta – kolme kertaa halvempi, 2,5-kertainen nopeus.

Saatavilla 28.5.2026, malli-ID claude-opus-4-8.

Etu kilpailijoihin pysyy, mutta kapenee

OpenAI:n GPT-5.5 ylsi viime testikierroksilla SWE-bench Pro -mittauksessa 58,6 prosenttiin ja Google DeepMindin Gemini 3.1 Pro 54,2 prosenttiin. Opus 4.8:n 69,2 prosenttia jättää siis välimatkaa noin kymmenen prosenttiyksikköä lähimpään seuraajaan.

Yksittäinen luku ei kuitenkaan kerro koko kuvaa. GPT-5.5 hallitsee yhä Terminal-Bench 2.0 -testiä 82,7 prosentin tuloksella, ja Gemini 3.1 Pro on edullisin ja nopein multimodaalisissa tehtävissä. Anthropicin etu painottuu nimenomaan ohjelmistosuunnittelun perinteisiin agenttitehtäviin: virhetikettien sulkemiseen, useamman tiedoston refaktorointiin ja työkalujen ketjuttamiseen.

Dynaamiset työnkulut – sata agenttia rinnan

Julkistuksen toinen pääuutinen on Claude Codeen ilmestynyt dynamic workflows -toiminto, joka on toistaiseksi research preview -vaiheessa. Sen avulla pääagentti voi käynnistää satoja alaista rinnakkain. Anthropic esittelee käyttötapauksena satojen tuhansien rivien koodikannan kerralla tehtävää migraatiota.

Sama suunta näkyy kilpailijoillakin: GPT-5.5:n Codex-tilassa ja Geminin Antigravityssa pyörii vastaavia agenttiparvia. Erottava tekijä on hinnoittelu. Kun jokainen alaisagentti laskuttaa omat tokeninsa, fast-tilan kolmasosaan painunut hinta tarkoittaa, että sadan rinnakkaisen agentin migraatioajo on Opusta käytettäessä karkeasti kaksi kertaa edullisempi kuin vielä maaliskuussa.

Mitä Reaktor, Futurice ja Nitor tekevät seuraavaksi?

Suomalaisten koodaustalojen kannalta uutinen kärjistää jo käynnissä olevaa keskustelua siitä, mistä asiakas todella maksaa. Reaktor ilmoitti aiemmin keväällä käynnistäneensä Helsingin yliopiston kanssa tutkimushankkeen, jonka tarkoitus on toimitusjohtaja Pekka Horon sanoin ’lopettaa spekulointi’ siitä, kuinka paljon kehittäjän työstä siirtyy mallille. Yhtiön tavoitteena on 60–90 miljoonan euron ohjelmistoliikevaihto vuoteen 2030 mennessä.

Pyysin keskiviikkona viestintäkommenttia Reaktorilta, Futuricelta ja Nitorilta siitä, miten Opus 4.8 vaikuttaa heidän tuntilaskutukseen perustuvaan malliinsa. Vastaukset eivät ehtineet ennen tämän jutun julkaisua, ja päivitän tekstin kun ne saapuvat. Nitor on kirjoittanut blogissaan jo aiemmin, että generatiivinen tekoäly on parhaimmillaankin ’väsymätön apuri, joka ei korvaa osaavaa koodaria’. Sama linja toistuu Reaktorin ja Futuricen julkisissa lausunnoissa.

Sanasto

Token
Tekstin perusyksikkö, jonka kielimalli käsittelee. Yksi token vastaa noin puolta suomenkielistä sanaa, ja mallien hinnoittelu perustuu käsiteltyjen tokenien määrään.
Agenttikoodaus
Tekoälymallin kykyä toimia itsenäisesti ohjelmoijan apurina: lukea koodikantaa, tehdä muutoksia useaan tiedostoon ja käyttää työkaluja ilman jatkuvaa ihmisen ohjausta.
Päättelyteho
Kuinka paljon laskenta-aikaa malli käyttää vastauksen miettimiseen. Korkea päättelyteho tuottaa harkitumpia vastauksia mutta on hitaampaa ja kalliimpaa.

Mistä asiakas maksaa, kun koodi muuttuu halvaksi?

Käytännön tasolla muutos näkyy ensimmäisenä isoissa migraatio- ja modernisointihankkeissa. Jos pankki on tilannut vanhan Java-monoliitin uudelleenkirjoituksen viiden hengen tiimiltä kuudeksi kuukaudeksi, dynamic workflows -tyylinen ajo voi tuottaa ensimmäisen version päivissä. Tarjouspyyntö siirtyy tuntien hinnoittelusta lopputuloksen hinnoitteluun.

Tavalliselle palvelunkäyttäjälle muutos tarkoittaa pidemmällä aikavälillä halvempaa digitaalista kehitystä julkisella sektorilla ja yrityksissä. Verottajan asiointipalvelun päivitys, kunnan ajanvarauksen modernisointi tai sähköisen reseptin parannukset eivät enää välttämättä vaadi sitä satatuhatta euroa, joka konsulttitalolta on aiemmin pyydetty. Konsulttiyrityksen on löydettävä uusi syy, miksi asiakas valitsee juuri sen. Kilpailu siirtyy mallin lisenssistä koodin laadunvarmistukseen ja kokonaisarkkitehtuurin osaamiseen, ja siinä lajissa kotimaiset talot ovat perinteisesti olleet vahvoja.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Datakeskukset Suomessa – hankkeet, sähkö ja vero
  4. 4Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.