Fable 5 ei ole enää ilmainen millään tasolla
Anthropic siirsi huippumallinsa Fable 5:n maksulliseksi 8. heinäkuuta. Muutos koskee kaikkia tilaustasoja Claude Prosta yritys- ja Enterprise-sopimuksiin. Ennen tätä osa käyttäjistä pääsi kokeilemaan mallia kiinteän kuukausimaksun rajoissa, mutta nyt sen käytöstä veloitetaan erikseen.
Hinta on 10 dollaria miljoonalta syötetyltä tokenilta ja 50 dollaria miljoonalta tuotetulta tokenilta. Käytännössä myös 17 dollaria kuussa maksava Claude Pro -tilaaja ostaa Fable 5:n käytön erillisillä krediiteillä. Kiinteä kuukausimaksu ei enää kata mallia.
Taustalla on lyhyt siirtymäjakso. Anthropic oli tarjonnut viikoittaisen 50 prosentin käyttöosuuden korvauksena 19 päivää kestäneen vientirajoituskatkon jälkeen. Tämä osuus umpeutui 7. heinäkuuta, ja seuraavana päivänä malli siirtyi kokonaan krediittipohjaiseen laskutukseen.
Mitä token-laskutus tarkoittaa tavalliselle tilaajalle
Token on tekstin pienin laskutusyksikkö. Karkeasti yksi token vastaa noin neljää merkkiä tai kolmea neljäsosaa sanasta. Laskutus jakautuu kahtia: syöte on kaikki, mitä mallille lähetetään, ja tuotos on kaikki, mitä malli kirjoittaa vastaukseksi. Tuotos on selvästi kalliimpaa, koska sen tuottaminen vaatii mallilta eniten laskentaa.
Ero muuttuu konkreettiseksi koodauskäytössä. Yksi Fable 5:llä ajettu agenttipohjainen koodaussessio, joka tuottaa kaksi miljoonaa tokenia, maksaa noin 100 dollaria krediiteissä. Sonnet 5:llä sama työ maksoi tutustumishinnalla noin 20 dollaria. Raskaalla käyttäjällä yhden päivän työskentely voi kasvattaa laskua sadoilla dollareilla kuukausimaksun päälle.
Fable 5:n hinnoittelu 8.7. alkaen
Syöte 10 dollaria / miljoona tokenia, tuotos 50 dollaria / miljoona tokenia. Sama krediittihinta koskee Claude Pro-, Max-, tiimi- ja yritystasoja. Enterprise-sopimuksissa Fable 5:tä ei ole koskaan sisällytetty käyttäjäpaikan hintaan, vaan se on aina laskutettu krediiteillä.
Miksi kärkimallin ajaminen maksaa niin paljon
Fable 5 on Anthropicin suorituskykyisin malli, ja se näkyy sekä tuloksissa että kustannuksissa. Yhtiön mukaan malli yltää yli 80 prosenttiin SWE-bench Pro -testissä, kun Sonnet 5 jää 63,2 prosenttiin. Parempi tulos syntyy suuremmasta mallista ja raskaammasta päättelystä, ja molemmat vaativat enemmän laskentaa jokaista vastausta kohti.
Käytännössä jokainen tuotettu token pyörii kalliilla GPU-kapasiteetilla, joka kuluttaa sähköä ja jäähdytystä. Kun malli lisäksi pohtii vastausta askel askeleelta, se tuottaa moninkertaisen määrän tokeneita yksinkertaiseen vastaukseen verrattuna. Vientirajoitukset ja niistä seurannut katko olivat muistutus siitä, kuinka herkkä laskentakapasiteetin saatavuus on.



