Tekoäly

Cursor Composer 2.5 haastaa Opus 4.7:n – kymmenesosan hinnalla

Cursorin koodimalli yltää kärkitasoon kahdessa kolmesta vertailutestistä

Nelli NelisanomaNelli Nelisanoma
Jaa:
Cursor Composer 2.5 haastaa Opus 4.7:n – kymmenesosan hinnalla

Yhdysvaltalainen koodieditori Cursor julkaisi 18. toukokuuta uuden Composer 2.5 -koodimallinsa, joka yltää kahdessa kolmesta julkisesta vertailutestistä Anthropicin Opus 4.7:n ja OpenAI:n GPT-5.5:n tasolle. Hinta on murto-osa kilpailijoista. Suomalaisille kehittäjille ja pienille ohjelmistoyhtiöille tulos voi muuttaa arkilaskelmaa siitä, mikä malli kannattaa pitää editorissa auki päivittäisessä työssä.

Kaksi kolmesta benchmarkista tasoissa

Composer 2.5 sai SWE-Bench Multilingual -testissä tuloksen 79,8 prosenttia ja CursorBench v3.1 -testissä 63,2 prosenttia. Molemmat osuvat käytännössä samaan haarukkaan kuin Opus 4.7-xhigh ja GPT-5.5-high. Terminal-Bench 2.0 -testissä Cursorin malli pääsi 69,3 prosenttiin, kun Opus 4.7 jäi 69,4 prosenttiin, eli ero on käytännössä mittausvirheen sisällä. GPT-5.5-high pitää Terminal-Benchissä yhä noin 13 prosenttiyksikön kärkeä, joten kaikilla osa-alueilla Composer ei vielä tavoita huippua.

Composer 2.5 pähkinänkuoressa

Julkaisupäivä: 18.5.2026. Hinta: 0,50 / 2,50 dollaria miljoonalta tokenilta (perus), 3 / 15 dollaria (nopea). SWE-Bench Multilingual: 79,8 %. CursorBench v3.1: 63,2 %. Terminal-Bench 2.0: 69,3 %. Pohja: Moonshotin Kimi K2.5. Ensimmäisen viikon ajan tuplakäyttö.

Hinta romahtaa murto-osaan

Cursor hinnoittelee Composerin perusversion 0,50 dollariin miljoonalta syötetokenilta ja 2,50 dollariin miljoonalta tuotostokenilta. Nopeampi variantti maksaa 3 ja 15 dollaria. Vertailun vuoksi Anthropicin Opus 4.7:n listahinta on 15 ja 75 dollaria miljoonalta tokenilta, eli Composer 2.5 jää syötepuolella noin kolmaskymmenesosaan ja tuotospuolella vastaavaan suhteeseen. The Decoder mittasi yhden agenttitehtävän kuluvan Composerilla alle dollarin, kun vastaava työ saattoi kohota kilpailijoiden malleilla yli yhteentoista dollariin.

Mitä tämä tarkoittaa suomalaiskehittäjälle

Suomalainen ohjelmistokehittäjä, joka käyttää tekoälyavustajaa tiiviisti normaalin työviikon ajan, kuluttaa karkeasti 15–25 miljoonaa tuotostokenia kuukaudessa. Composer 2.5:n perushinnoittelulla kuukausilasku jää 35–65 dollarin tienoille. Sama käyttö Opus 4.7-xhighilla kohoaa helposti 1 000 dollarin tuntumaan, Cursorin nopeammallakin variantilla 230–375 dollariin.

Pienille suomalaisstartupeille ja yksin koodaaville konsulteille ero on konkreettinen: kymmenien tuhansien eurojen vuosittainen säästö per kehittäjä, jos malli pysyy oman työn vaatimusten tasolla. Erityisesti tiimeissä, joissa AI-kulut ovat jo nyt suurin yksittäinen menoerä henkilöstön jälkeen, lasku muuttaa budjettilaskelman luonnetta täysin.

Kimi K2.5:n päältä, seuraava malli SpaceX:llä

Cursor kertoo treenanneensa Composer 2.5:n Moonshotin avoimen Kimi K2.5 -tarkistuspisteen päältä. 85 prosenttia laskennasta meni jatkokoulutukseen ja vahvistusoppimiseen, ja synteettistä koulutusdataa oli 25 kertaa enemmän kuin Composer 2:ssa. Yhtiö rakentaa myös selvästi suurempaa seuraavaa mallia yhdessä SpaceX:n kanssa Colossus-2 -klusterilla, joka käsittää noin miljoona H100-vastinetta. Composer 2.5 ei vielä ole tuon laskennan tulosta, vaan SpaceX-yhteistyö koskee seuraavaa versiota, jonka kokonaislaskenta on kymmenkertainen nykyiseen verrattuna.

Sanasto

Benchmark
Vertailutesti, jolla mitataan tekoälymallien suorituskykyä samoilla tehtävillä. Esimerkiksi SWE-Bench testaa koodausmallien kykyä korjata oikeita ohjelmointivirheitä.
Tarkistuspiste (checkpoint)
Tallennettu välivaihe tekoälymallin koulutuksesta. Muut tutkijat voivat ladata tarkistuspisteen ja jatkaa siitä omaan suuntaansa ilman, että koulutus täytyy aloittaa alusta.
Vahvistusoppiminen
Koulutusmenetelmä, jossa malli oppii palkitsemisen ja rankaisun kautta. Käytetään erityisesti opettamaan tekoäly seuraamaan ohjeita ja tekemään päätöksiä iteratiivisissa tehtävissä.

Mallien tasoittuminen siirtää painopistettä raa'asta älystä editori-integraatioon ja hintaan. Cursorin oma malli pyörii tehokkaimmin Cursorin omassa työkalussa, mikä sitoo käyttäjän aiempaa tiukemmin yhteen ekosysteemiin. Anthropicin ja OpenAI:n linja on ollut päinvastainen: niiden API on auki kaikille editoreille. Suomalaisilla tiimeillä on syytä testata Composeria oikealla koodipohjalla ensimmäisen tuplakäyttöviikon aikana ennen kuin Opus-tilauksen automaattinen uusiminen lähtee taas pyörimään.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.