Tekoäly

Koodikatselmointiin tuli agenttiarmeija

Claude Code Review löytää 7,5 ongelmaa per muutos – alle prosentti vääriä hälytyksiä

Nelli NelisanomaNelli Nelisanoma
Jaa:
Koodikatselmointiin tuli agenttiarmeija

Anthropic julkisti maanantaina Claude Code Review -työkalun, joka lähettää joukon tekoälyagentteja katselmoimaan pull requesteja rinnakkain. Järjestelmä integroituu suoraan GitHub:iin ja käynnistyy automaattisesti, kun uusi pull request avataan. Useat agentit tarkastavat koodimuutokset eri lähtökohdista, suodattavat löydökset verifiointivaiheessa ja priorisoivat ne vakavuuden mukaan.

Sisäisissä testeissä työkalu löysi yli tuhannen rivin muutoksista keskimäärin 7,5 ongelmaa. Alle prosentti havainnoista osoittautui vääriksi positiivisiksi. Kyseessä on Anthropicin vastaus ongelmaan, joka on kasvanut tekoälyavusteisen koodauksen myötä: pull requesteja syntyy nopeammin kuin kehitystiimit ehtivät katselmoida.

Rinnakkaiset agentit, eri näkökulmat

Perinteisessä koodikatselmoinnissa yksi kehittäjä selaa muutokset läpi ja yrittää huomata kaiken kerralla. Claude Code Review pilkkoo tehtävän osiin. Kun pull request avataan, järjestelmä lähettää useita agentteja tarkastamaan koodia samanaikaisesti. Kukin agentti etsii erityyppisiä ongelmia: logiikkavirheitä, tietoturva-aukkoja, rikkoutuvia reunatapauksia ja hienovaraisia regressioita. Kyse ei ole pelkästä lint-tarkistuksesta, vaan agentit analysoivat koodin toiminnallista logiikkaa.

Löydökset eivät päädy suoraan kehittäjän näytölle. Jokainen havainto käy läpi erillisen verifiointivaiheen, jossa se tarkistetaan koodin todellista käyttäytymistä vasten. Tämä vaihe on keskeinen syy siihen, miksi väärät positiiviset jäävät alle prosenttiin. Vasta suodatuksen jälkeen ongelmat priorisoidaan vakavuuden mukaan ja esitetään kehittäjälle yhteenvetona sekä rivikohtaisina kommentteina.

Järjestelmä skaalautuu muutoksen koon mukaan. Isommat pull requestit saavat syvemmän analyysin useammalta agentilta, kun taas pieniä korjauksia katselmoidaan kevyemmin. Keskimääräinen katselmointiaika on noin 20 minuuttia, mikä on murto-osa ihmiskatselmoijan käyttämästä ajasta.

Luvut puhuvat puolestaan

Anthropicin sisäisessä testauksessa 84 prosenttia isoista, yli tuhannen rivin pull requesteista sai löydöksiä, keskimäärin 7,5 ongelmaa per katselmointi. Pienemmissä, alle 50 rivin muutoksissa löydöksiä sai 31 prosenttia ja keskiarvo jäi puoleen ongelmaan. Työkalu mukautuu koodimuutoksen kokoon eikä yritä löytää ongelmia sieltä, missä niitä ei ole.

Alle prosentti työkalun havainnoista merkittiin virheellisiksi. Se on poikkeuksellisen matala taso automaattiselle koodianalyysille. Monet staattiset analyysityökalut tuottavat niin paljon kohinaa, että kehittäjät lopettavat niiden käytön kokonaan.

Merkityksellisten katselmointikommenttien osuus nousi Anthropicin sisäisessä käytössä 16 prosentista 54 prosenttiin. Käytännössä yli puolet pull requesteista saa nyt konkreettista, koodin laatua parantavaa palautetta. Aiemmin osuus oli vain kuudesosa, joten kasvu on yli kolminkertainen.

Anthropic ei ole toistaiseksi julkaissut tarkkaa vakavuusjakaumaa löydöksistä, esimerkiksi sitä, kuinka suuri osa on kriittisiä tietoturva-aukkoja ja kuinka moni matalan riskin laatuhuomio. Tämä tieto olisi erityisen arvokasta organisaatioille, jotka haluavat arvioida työkalun turvallisuuslisäarvoa.

Koodikatselmointi on kallis pullonkaula

Stack Overflow:n kehittäjäkyselyn mukaan keskiverto ohjelmistokehittäjä käyttää koodikatselmointiin noin viisi tuntia viikossa. Tutkimusten mukaan yli 500 koodirivin tarkistaminen tunnissa heikentää virheiden havaitsemista merkittävästi. Tuhannen rivin pull request vaatii ihmiseltä 2,5–5 tuntia huolellista läpikäyntiä.

Claude Code Review tekee saman noin 20 minuutissa ja veloittaa 15–25 dollaria per katselmointi. Hinta skaalautuu muutoksen koon ja monimutkaisuuden mukaan. Kun kehittäjän kokonaistuntikustannus liikkuu 100–170 dollarissa, kolmen tunnin manuaalinen katselmointi maksaa yritykselle 300–510 dollaria. Ero on yli kymmenkertainen.

Kustannusero korostuu organisaatioissa, joissa tekoälyavusteinen koodaus on kasvattanut pull requestien määrää nopeammin kuin katselmointikapasiteetti. Katselmoinnista on tullut pullonkaula, joka hidastaa koodin etenemistä tuotantoon. Automaattinen katselmointi purkaa jonoa ja antaa kehittäjille mahdollisuuden korjata ongelmat ennen kuin ihmiskatselmoija edes avaa muutokset.

< 1 %

Vääriä positiivisia havainnoista

7,5

Löydöstä keskimäärin per iso PR

84 vs. 31 %

Löydösaste isoissa vs. pienissä PR:issä

16 → 54 %↑

PR:ien osuus merkityksellisellä palautteella

Anthropic, Claude Code Blog, 2026

Ison PR:n katselmointi: kone vs. ihminen

Claude Code Review

Rinnakkaiset agentit, automaattinen suodatus

Katselmointiaika
~20 min
Kustannus
15–25 $
Fokus
Bugit, tietoturva, regressiot

Ihmiskatselmoija

Yksi kehittäjä käy läpi koko muutoksen

Katselmointiaika
2,5–5 tuntia
Kustannus
300–510 $
Fokus
Tyyli, nimeäminen, arkkitehtuuri

Anthropic & Codacy Blog, 2026

Sanasto

Pull request
Koodimuutos jonka kehittäjä lähettää tiiminsä tarkistettavaksi ennen kuin se liitetään osaksi ohjelmistoa. Toimii laadunvarmistuksen porttina.
Regressio
Tilanne jossa koodimuutos rikkoo aiemmin toimineen ominaisuuden – esimerkiksi bugikorjaus joka aiheuttaa uuden virheen toisaalla.

Katselmoinnin uusi työnjako

Työkalu on toistaiseksi saatavilla tutkimuskäyttöön Claude Team- ja Enterprise-asiakkaille. Ylläpitäjät voivat asettaa kuukausittaisen kustannuskaton ja hallita, mitkä repositoriot käyttävät automaattista katselmointia. Anthropicin lisäksi myös GitHub:n Copilot ja CodeRabbit tarjoavat katselmointiratkaisujaan, joten kilpailu alalla kiihtyy.

Perinteisen koodikatselmoinnin tutkimus tarjoaa kiinnostavan vertailukohdan. Vain 15 prosenttia ihmiskatselmoijien kommenteista koskee todellisia virheitä. Loput 85 prosenttia käsittelevät tyyliseikkoja, nimeämiskäytäntöjä ja dokumentaatiota. Claude Code Review keskittyy nimenomaan bugeihin ja tietoturvaongelmiin, mikä vapauttaa ihmiskatselmoijat keskittymään arkkitehtuuriin ja liiketoimintalogiikkaan.

Suomalaisille ohjelmistotaloille työkalu avaa mahdollisuuden tehostaa laadunvarmistusta ilman lisärekrytointeja. Kun rutiinikatselmointi siirtyy koneelle, seniorikehittäjien aikaa vapautuu monimutkaisempiin suunnittelupäätöksiin. Se on muutos, joka näkyy sekä koodin laadussa että kehitystiimin arjessa.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.