Anthropic julkaisi tiistaina 17. helmikuuta Claude Sonnet 4.6 -mallin – vain kaksi viikkoa Opus 4.6:n jälkeen. Uutuus on nyt oletusmallinaan sekä ilmais- että Pro-käyttäjille claude.ai-palvelussa. Hintaa ei nostettu: 3 dollaria per miljoona syötetokenia ja 15 dollaria per miljoona tuotostokenia. Se on viidennes Opuksen hinnasta.
Luvut ovat huomattavia. SWE-bench Verified -koodaustestissä Sonnet 4.6 sai 79,6 prosenttia – vain 1,2 prosenttiyksikköä Opus 4.6:n alapuolella. OSWorld-tietokoneen käyttötestissä tulos oli 72,5 prosenttia, kun Opus pääsi 72,7:ään. Kehittäjät suosivat Claude Code -testauksessa Sonnet 4.6:ta Sonnet 4.5:n sijaan 70 prosentissa tapauksista ja jopa edellisen lippulaivan Opus 4.5:n sijaan 59 prosentissa tapauksista.
Miljoona tokenia ja kontekstin tiivistys
Sonnet 4.6 tuo mukanaan beetassa miljoonan tokenin konteksti-ikkunan – tarpeeksi kokonaisen koodipohjan, pitkien sopimusten tai kymmenien tutkimuspapereiden syöttämiseen yhdellä kertaa. Anthropic esitteli samalla context compaction -ominaisuuden, joka tiivistää vanhaa keskusteluhistoriaa automaattisesti. Käytännössä agentti-istunnot voivat jatkua rajattomasti ilman, että konteksti loppuu kesken.
TechCrunchin mukaan Sonnet 4.6 on ensimmäinen Sonnet-tason malli, joka tukee koko koodipohjan analysointia yhdessä kehotteessa. ARC-AGI-2-testissä malli sai 60,4 prosenttia – enemmän kuin useimmat kilpailijat, vaikka Opus 4.6 ja Googlen Gemini 3 Deep Think pärjäsivät vielä paremmin.
Kehittäjät reagoivat – innostusta ja skeptisyyttä
Hacker Newsin keskustelussa Handy-Man nosti esiin hinta-laatusuhteen: malli on "2–3 kertaa halvempi" kuin Opus, mutta pärjää lähes yhtä hyvin. cube2222 kuvaili Sonnet 4.6:ta "voitoksi kaikille, jotka rakentavat agenttipohjaisia tekoälyavustajia" parannetun työkalunkäytön ansiosta.
X:ssä käyttäjä underwood kertoi yllättyneensä mallin tasosta: hän oli tottunut säätämään Geminin ja ChatGPT:n tuottamia kehotteita käsin, mutta Sonnet 4.6:n tuotokset olivat "heti käyttökelpoisia". Visual Studio Code -tiimi ilmoitti mallin olevan saatavilla suoraan editorissa GitHub Copilotin kautta.
Kaikki eivät kuitenkaan olleet varauksetta innoissaan. Hacker Newsin deanc kritisoi Anthropicin vertailujen valikoivuutta ja kysyi, miksi uutta mallia ei verrattu suoraan OpenAI:n tuoreimpaan 5.3-codex-malliin. Käyttäjä rvz puolestaan epäili, pystyykö Anthropic pitämään etumatkansa avoimen lähdekoodin malleihin nähden pitkällä aikavälillä.



