Tekoäly

Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita

Viikko sitten julkaistu Jev ei tuota sanaakaan tekstiä. Selitämme, mitä sille annetaan, mitä se antaa takaisin ja mihin sitä jo käytetään.

Venla ValoVenla Valo
Jaa:
Jeville annetaan asiakkaan viesti ja kysymys, ja se vastaa kyllä 94 prosentin varmuudella

Jev julkaistiin tiistaina 15. syyskuuta, ja viikossa siitä on tullut tekoälykehittäjien puhutuin uutuus. Mallin takana on TypeSafe AI, jonka perustaja Diogo Almeida oli OpenAI:lla mukana kehittämässä menetelmää, jolla GPT-3:sta tehtiin ChatGPT. Kerroimme julkistuksesta ja 40 miljoonan dollarin rahoituksesta heti tuoreeltaan. Tämä juttu selittää rauhassa, mikä Jev oikeastaan on.

Lyhyesti: Jev tekee pieniä päätöksiä. Se kertoo joka päätöksen mukana, kuinka varma se on, joten ohjelma tietää, milloin päätökseen voi luottaa ja milloin asia pitää nostaa ihmiselle. Ja kun yksi päätös ei maksa käytännössä mitään, tekoälylle kannattaa antaa paljon enemmän päätöksiä kuin nyt.

Kielimalli kirjoittaa, Jev päättää

Tavallinen kielimalli, kuten ChatGPT, Claude tai Gemini, kirjoittaa vastauksen sana kerrallaan. Jokainen sana odottaa edellistä, joten vastaus kestää sekunteja ja maksaa joka sanasta. Vastaus on vapaata tekstiä, jonka rakenne pitää vielä tarkistaa, ennen kuin ohjelma voi käyttää sitä.

Kielimalli saa kysymyksen ja kirjoittaa tekstiä, Jev saa tilanteen ja kysymyksen ja antaa päätöksen varmuusprosentteineen
Kielimalli kirjoittaa, Jev päättää. Vasteajat ja hinnat ovat TypeSafe AI:n ilmoittamia.Kuva: AI Suomi

Jev toimii toisin. Sille annetaan tilanne, vaikkapa asiakkaan sähköposti tai lomakkeen kentät, ja lista kysymyksiä siitä. Se vastaa kaikkiin kysymyksiin kerralla, yhtiön mukaan 70–500 millisekunnissa eli alle puolessa sekunnissa. Se ei selitä, ei perustele eikä keskustele. Se vain päättää.

TypeSafe kutsuu Jeviä System One -malliksi. Nimitys viittaa psykologi Daniel Kahnemanin jakoon nopeaan ja hitaaseen ajatteluun. Jev on se nopea: vaisto ilman perusteluja. Itse Jev-nimi tulee Jevonsin paradoksista, jonka mukaan tarpeeksi halvaksi tullutta asiaa aletaan käyttää niin paljon enemmän, että kokonaiskulutus kasvaa.

Mitä Jeville annetaan ja mitä se antaa takaisin

Jeville annetaan asiakkaan viesti ja kysymys, ja se vastaa kyllä 94 prosentin varmuudella
Mitä Jeville annetaan ja mitä se antaa takaisin. Esimerkki.Kuva: AI Suomi

Kysymyksiä on kolmea lajia. Valinta (choice): mihin luokkaan tämä kuuluu? Asteikko (score): matala, keskitaso vai korkea? Kyllä tai ei (noul): onko tämä kiireellinen? Yksi kysymys voi sisältää enintään 255 vaihtoehtoa, ja isommat valinnat pitää pilkkoa kahteen vaiheeseen.

Jokaisen vastauksen mukana tulee todennäköisyys, eli malli kertoo, kuinka varma se on. Vastaus on aina ennalta sovitussa muodossa: luokka, asteikon taso tai kyllä/ei. Vapaata tekstiä Jev ei tuota koskaan.

Jevin kolme vastaustapaa: valinta, asteikko ja kyllä tai ei, jokainen varmuusprosentilla
Jev vastaa aina yhdellä kolmesta tavasta. Esimerkkiluvut.Kuva: AI Suomi

Miksi varmuusprosentti on koko jutun ydin

Koska Jev kertoo jokaisen päätöksen mukana, kuinka varma se on, ohjelmisto voi asettaa rajan. Yli 95 prosentin varmuudella ohjelma toimii itse. Sen alle jäävät tapaukset menevät ihmiselle tai isommalle mallille. TypeSafe väittää, että rajan avulla hallusinaatiot voidaan painaa nollaan.

Väite pitää paikkansa vain, jos mallin varmuus on kalibroitu eli rehellinen: 80 prosentin varmuus osuu oikeaan noin neljä kertaa viidestä. Juuri siihen yhtiön uusi opetusmenetelmä RLCD, Reinforcement Learning for Calibrated Decisions, on sen mukaan tehty. Ulkopuolisia mittauksia kalibroinnista ei vielä ole.

Hinnoittelu on osa viestiä. Malliin syötetty teksti maksaa 0,042 dollaria miljoonalta tokenilta, ja vastaukset ovat ilmaisia. Omissa testeissään yhtiö mittasi Jevin 40–200 kertaa nopeammaksi ja 40–400 kertaa halvemmaksi kuin verrokit. Luvut ovat yhtiön omia, minkä Almeida itse muistuttaa: ”Poikkeukselliset väitteet vaativat poikkeuksellisia todisteita.”

Mihin sitä käytetään

Almeidan väite on, että suurin osa ohjelmistojen sisällä tarvittavasta älykkyydestä ei ole kirjoittamista. Se on pieniä päätöksiä: kuuluuko tämä viesti reklamaatioihin vai laskutukseen, onko käyttäjän syöte turvallinen, saako tämän laskun hyväksyä ilman ihmistä. Käyttökohteita ovat viestien luokittelu ja ohjaus oikeaan paikkaan, tiedon poiminta, pisteytys ja toisen mallin vastausten tarkistus.

Kehittäjätyökaluja tekevä LangChain kuvasi 17. syyskuuta, miten Jev sopii tekoälyagentin sisälle. Iso malli, vaikkapa Claude, päättelee ja kirjoittaa. Jev tekee välissä nopeat päätökset: onko pyyntö helppo vai vaikea, ja saako tämän komennon ajaa ilman lupaa? Sama kuvio on tuttu koodausagenteista, joiden automaattitila päättää, mikä komento saa mennä läpi ja mikä kysytään käyttäjältä.

Neljä päivää julkaisun jälkeen Jevillä oli tehty jo yli sata avointa projektia. Lennokki lentää esteradan simulaattorissa ja kysyy Jeviltä noin 0,4 sekunnin välein, väistääkö vai jarruttaako. Postgres-laajennus hakee tietokannasta sanallisella ehdolla, esimerkiksi ”nimi on eurooppalainen”, ja kaksituhatta riviä maksoi noin sentin. Suomalainen Bitmagic antoi Jevin ohjata kaupunkipelin liikennevaloja. Luvut ovat tekijöiden omia.

Missä sitä voi kokeilla

Jeviä voi kokeilla heti. OpenRouterissa se on nimellä typesafe/jev-1.13 ja Vercelin AI Gatewayssa nimellä typesafe-ai/jev. Hinta on molemmissa sama kuin TypeSafella, jonka omaan rajapintaan pääsee vielä jonotuslistalta. LangChainille on oma kirjasto, langchain-typesafe, ja omaan Claude-agenttiin Jevin voi kytkeä työkaluksi.

Suomalaiselle käyttäjälle on yksi varaus. TypeSafen ohjeiden mukaan malli on viritetty englanniksi, joten suomenkielinen aineisto kannattaa testata kunnolla ennen tuotantokäyttöä.

Mitä Jev ei tee

Rajoitteet ovat yhtä selviä kuin lupaukset. Jev ei kirjoita sähköpostia, ei tiivistä raporttia eikä perustele valintojaan. Se ei korvaa kielimallia vaan täydentää sitä: kielimalli hoitaa tekstin, Jev päätökset. Ulkopuolisia vertailuja ei vielä ole, ja vasta muiden kehittäjien omat mittaukset kertovat, pitääkö lupaus sata kertaa halvemmasta tekoälystä.

Sanasto

System One -malli
TypeSafen nimitys mallille, joka antaa nopean päätöksen ilman päättelyketjua. Viittaa Daniel Kahnemanin jakoon nopeaan (System 1) ja hitaaseen (System 2) ajatteluun.
Noul
Jevin kyllä tai ei -kysymys. Vastaus on todennäköisyys sille, että vastaus on kyllä.
Kalibroitu todennäköisyys
Mallin ilmoittama varmuus vastaa sen todellista osumatarkkuutta: 80 prosentin varmuus on oikeassa noin neljä kertaa viidestä.
Token
Tekstin palanen, jolla kielimallien hinnat lasketaan. Suomenkielinen sana on tyypillisesti 2–4 tokenia.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.