Dario Amodei kirjoitti syyskuun alussa blogiinsa, että tekoälyn kehitystahtia pitäisi hillitä. Muutamaa viikkoa myöhemmin hänen johtamansa Anthropic julkaisi uuden huippumallin. Se on edeltäjäänsä halvempi, ja yhtiön mukaan se on vahvin malli, jota Anthropic on tähän mennessä testannut.
Samana tiistaina, 22. syyskuuta, OpenAI julkaisi GPT-6-sarjan mallit Solin ja Lunan ja kertoi niiden API-hinnan olevan noin puolet edellisen 5.6-sarjan hinnasta. Alan kaksi suurinta kilpailijaa siis laski hintojaan samana päivänä.
Mitä halpeni ja kuinka paljon
Rajapinnan kautta Opus 5.5 maksaa 4 dollaria miljoonalta syötetokenilta ja 20 dollaria miljoonalta tulostetokenilta. Opus 5:n hinnat olivat 5 ja 25 dollaria, joten tokenikohtainen hinta laski viidenneksellä. Välimuistista luettavien tokenien hinta laski 60 prosenttia.
Anthropicin mainostama 40 prosentin säästö on eri luku. Yhtiö kirjoittaa englanninkielisessä tiedotteessaan, että "testimme osoittavat, että oletusasetuksilla se maksaa tyypillisissä työkuormissa 40 % vähemmän kuin Opus 5". Säästö tulee halvemmista tokeneista ja siitä, että malli tarvitsee yhtiön mukaan tehtäviin vähemmän tokeneita. Luku perustuu Anthropicin omaan mittaukseen.
OpenAI:n 50 prosentin hinnanlasku on toistaiseksi yhden lähteen varassa. Se perustuu TechCrunchin raportointiin, sillä OpenAI:n omaa julkaisusivua emme saaneet auki. TechCrunchin mukaan OpenAI selittää laskua välimuistin ja päättelyn tehostumisella. Sol on tarkoitettu vaativiin tehtäviin, kuten ohjelmointiin. Luna taas on tehty "suuren volyymin tehtäviin, joissa on selvä tavoite, kuten dokumenttien tiivistämiseen, tiedon poimimiseen tai nopeisiin kysymyksiin vastaamiseen".
Ilmaiskäyttäjä saa uuden mallin heti
Tavalliselle ChatGPT:n käyttäjälle tärkein uutinen on Luna. TechCrunchin mukaan se tulee myös maksuttoman Free-tason ja edullisen Go-tilauksen käyttäjille, ja se otetaan käyttöön vähitellen julkaisupäivän mittaan. Maksavat asiakkaat saavat sekä Solin että Lunan ChatGPT Workiin ja Codexiin.
Anthropic ei maininnut ilmaiskäyttäjiä julkaisutiedotteessaan. Se kertoo sen sijaan nostavansa maksullisten Pro-, Max-, Team- ja Enterprise-tilausten viiden tunnin käyttörajoja. Kuluttajalle Clauden halpeneminen näkyy siis lähinnä siinä, että samalla kuukausimaksulla saa tehtyä enemmän.
Yrityksissä muutos näkyy suoremmin. Ajatellaan suomalaista ohjelmistotaloa, jonka asiakaspalvelubotti tiivistää joka päivä tuhansia tukipyyntöjä. Yhtiöiden omien lukujen mukaan sama työ maksaa nyt viidenneksen tai jopa puolet vähemmän, eikä koodiin tarvitse yleensä muuttaa kuin mallin nimi. Käyttötapaukset, jotka olivat aiemmin kannattavuuden rajalla, voivat muuttua kannattaviksi.
Suorituskykyväitteet ovat yhtiöiden omia
Anthropicin mukaan Opus 5.5 yltää useimmissa tehtävissä isomman Fable 5.1 -mallin tasolle. TechCrunchin mukaan OpenAI puolestaan väittää, että GPT-6 Sol tekee noin puolet vähemmän virheitä kuin edeltäjänsä ja että molemmat uudet mallit päihittävät Anthropicin Opus- ja Fable-mallit. Kumpaakaan väitettä ei ole vahvistettu riippumattomasti. OpenAI:n virheluku perustuu sen omaan sisäiseen arviointiin.
Mitä hidastaminen tarkoittaa
Amodein kirjoitus ja Opus 5.5 näyttävät ensi silmäyksellä olevan ristiriidassa. Kirjoituksessa ei kuitenkaan vaadita julkaisujen lopettamista. Amodei toteaa suoraan, ettei kehitystahdin hillitseminen tarkoita mallien koulutuksen tai teknisen kehityksen pysäyttämistä.
“Viime kuukausina olen kuitenkin vakuuttunut siitä, että riskien täysimääräinen käsittely vaatii vielä enemmän varovaisuutta – ei pelkästään panostamista riskien ehkäisyyn, vaan kyvykkyyksien kehitysvauhdin tahdittamista niin, että riskien ehkäisy ehtii pysyä mukana.”



