OpenAI julkaisi eilen GPT-5.4:n, yhtiön toistaiseksi tehokkaimman kielimallin. Julkaisun keskiössä on ominaisuus, jota koko ala on odottanut: malli osaa käyttää tietokonetta itsenäisesti hiiren ja näppäimistön avulla. Ennakkoon vuotaneet tiedot antoivat esimakua, mutta viralliset speksit paljastavat mallin todellisen tason.
GPT-5.4 tulee kolmena versiona: perusmallina, päättelyyn erikoistuneena Thinking-versiona ja raskaaseen ammattikäyttöön suunniteltuna Pro-versiona. API-version konteksti-ikkuna on kasvanut miljoonaan tokeniin, mikä on yli kaksinkertainen edeltäjään verrattuna. Malli korvaa GPT-5.2:n oletuksena sekä ChatGPT:ssä että API:ssa.
Ihmisiä parempi tietokoneen käyttäjä
OSWorld-Verified-testissä, joka mittaa tekoälyn kykyä suoriutua työpöytätehtävistä kuvakaappausten ja hiiren avulla, GPT-5.4 saavuttaa 75 prosentin onnistumisasteen. Ihmisten tulos samassa testissä on 72,4 prosenttia. Edeltäjä GPT-5.2 jäi 47,3 prosenttiin, joten parannus on valtava.
Kyseessä on ensimmäinen kerta, kun yleiskäyttöinen kielimalli ylittää ihmistason itsenäisessä tietokoneen käytössä. GPT-5.4 pystyy navigoimaan ohjelmistoja, täyttämään lomakkeita, siirtymään sovellusten välillä ja suorittamaan monivaiheisia tehtäviä ilman jatkuvaa ohjausta. OpenAI korostaa, että koneenkäyttökyky on rakennettu suoraan malliin eikä toimi erillisenä lisäosana.
Tietokoneen käyttö ei ole ainoa parannus. GDPval-testissä, joka arvioi suoriutumista 44 ammattialan tehtävissä, malli saa 83 prosentin tuloksen. GPT-5.4 tekee 33 prosenttia vähemmän virheellisiä väitteitä ja 18 prosenttia vähemmän asiavirheitä kuin edeltäjänsä. Visuaalisessa ymmärryksessä MMMU-Pro-testin tulos on 81,2 prosenttia.
Huippumallien hinta ja vahvuudet
GPT-5.4
OpenAI:n uusin lippulaivamalli
- Syötehinta
- 2,50 $ / 1M tokenia
- Tulostehinta
- 15 $ / 1M tokenia
- Konteksti-ikkuna
- 1 miljoona tokenia
- Vahvin osa-alue
- Tietokoneen käyttö (OSWorld 75 %)
Claude Opus 4.6
Anthropicin päättelymalli
- Syötehinta
- 5 $ / 1M tokenia
- Tulostehinta
- 25 $ / 1M tokenia
- Konteksti-ikkuna
- 200 000 tokenia
- Vahvin osa-alue
- Koodin korjaus (SWE-Bench 80,8 %)
Gemini 3.1 Pro
Googlen edullisin huippumalli
- Syötehinta
- 2 $ / 1M tokenia
- Tulostehinta
- 12 $ / 1M tokenia
- Konteksti-ikkuna
- 2 miljoonaa tokenia
- Vahvin osa-alue
- Päättely (GPQA Diamond 94,3 %)
Miljoonan tokenin muisti
API-version konteksti-ikkuna yltää miljoonaan tokeniin. Se on OpenAI:n suurin koskaan ja mahdollistaa kokonaisten koodikantojen, pitkien sopimusten tai laajojen tutkimusaineistojen käsittelyn kerralla. Käytännössä miljoonaan tokeniin mahtuu karkeasti arvioituna noin 750 000 sanaa eli useita kokonaisia kirjoja.
Tokenien kulutuksessa GPT-5.4 on selvästi edeltäjäänsä tehokkaampi. Uusi tool search -järjestelmä hakee työkalumäärittelyt vasta tarvittaessa sen sijaan, että ne ladattaisiin kerralla. Tämä vähentää tokenien käyttöä 47 prosenttia vertailutehtävissä tarkkuuden kärsimättä. Koodaustehtävissä Codex-alustan fast-tila tuottaa tokeneita puolitoistakertaisella nopeudella.



