Tekoäly

Qwen3.7 koodasi 35 tuntia putkeen – ja teki oman sirunsa softan

1 158 työkalukutsua ja kymmenkertainen nopeus Tritoniin – toimii suoraan Claude Codessa.

Hanna HuulivuoHanna Huulivuo
Jaa:
Qwen3.7 koodasi 35 tuntia putkeen – ja teki oman sirunsa softan
Kuva: N509FZ / CC BY-SA 4.0

Alibaba julkaisi viime viikolla Qwen3.7 Max -kielimallin ja osoitti sen voiman epätavallisella demolla. Malli sai eteensä tuntemattoman GPU-sirun ja tehtävän: optimoi yksi sen ydinkerneleistä. Yhtäjaksoisen 35 tunnin työrupeaman jälkeen kerneli pyöri kymmenen kertaa nopeammin kuin alkuperäinen Triton-toteutus.

35 tuntia, 1 158 työkalukutsua, 432 kernelitestiä

Demon kohteena oli ZW-M890 PPU, sirupakkaus, jota Qwen3.7 Maxin koulutusdatassa ei ollut. Mallilla ei ollut käytössään valmistajan dokumentaatiota, profilointityökaluja eikä esimerkkikoodia. Sen piti ensin selvittää, miten siru toimii, sitten kirjoittaa profilointi-, debug- ja vertailurutiinit, ja lopulta iteroida kernelin nopeutta ylöspäin.

Mittauksen mukaan malli teki 1 158 erillistä työkalukutsua ja ajoi kernelin 432 kertaa korjausten välissä. Yhteensä yli puolitoista vuorokautta yhtenäistä optimointistrategiaa, jonka kaikki välivaiheet pysyivät yhden konteksti-ikkunan sisällä. Ikkunan koko on miljoona tokenia, karkeasti kaksituhatta sivua tekstiä.

Tuntematon siru, kymmenkertainen nopeus

Lopputulos: geometrisesti keskimäärin 10× nopeampi Extend Attention -kerneli kuin Triton-referenssissä. Luku on merkityksellinen siksi, että Triton on tällä hetkellä standardi tapa kirjoittaa GPU-ytimiä Pythonista käsin. Jos kielimalli pystyy iteroimaan kymmenkertaiseen tehoon ilman ihmistä, sirujen ohjelmistosuunnittelun pullonkaula alkaa siirtyä toiseen paikkaan.

Qwen3.7 Max ei ole vain yhden tehtävän malli. SWE-Bench Pro -mittarissa Alibaba ilmoittaa pisteeksi 60,6 prosenttia, jolla se kiilaa Claude Opus 4.6:n 57,3 prosentin edelle. Terminal-Bench 2.0 antoi 69,7 prosenttia ja MCP-Atlas 76,4 prosenttia. Numerot ovat valmistajan ilmoittamia ja odottavat riippumatonta vahvistusta.

60,6 %↑

SWE-Bench Pro – ohi Claude Opus 4.6:n (57,3 %)

69,7 %

Terminal-Bench 2.0

76,4 %

MCP-Atlas (työkalukutsut)

35 h

Yhtäjaksoinen autonominen koodaus

Alibaba / BuildFastwithAI 2026

Swap-vaihto Claude Codeen kolmella muuttujalla

Käytännön merkitys suomalaiselle kehittäjälle tiivistyy yhteen tekniseen yksityiskohtaan: Qwen3.7 Max puhuu natiivisti Anthropicin API-protokollaa. Jos käytät Claude Codea terminaalissa, vaihto Alibaban malliin onnistuu kolmella ympäristömuuttujalla. Base URL, API-avain ja mallin nimi osoittavat DashScope-palvelimelle, eikä itse Claude Codeen tarvitse koskea muuten.

Hinnoittelu on aggressiivinen. Sisääntuleva token maksaa 2,50 dollaria miljoonalta, ulostuleva 7,50 dollaria, välimuistitettu sisääntulo 0,25 dollaria. Tämä tekee Qwen3.7 Maxista noin kuusi kertaa halvemman kuin Claude Opus 4.7 syötteen osalta. Pitkissä agenttitehtävissä, joissa konteksti-ikkuna täyttyy nopeasti, ero kertautuu kuukausilaskussa.

Google sulkee, Alibaba avaa

Vastakohta Googlen tämänviikkoiseen tiedotteeseen on ilmiselvä. Yhdysvaltalainen jätti ilmoitti sammuttavansa avoimen lähdekoodin Gemini CLI:n ja sulauttavansa sen toiminnot Gemini-sovellukseen. Alibaba sen sijaan avasi yhteensopivuuden suoraan kilpailijansa agenttikehykseen. Suomalaisilla kehittäjillä on nyt yksi vaihtoehto vähemmän Googlen puolelta ja yksi lisää Alibaban.

Luvut ovat Alibaban itse mittaamia

Riippumatonta toistoa 35 tunnin ajosta ei ole vielä julkaistu, eivätkä benchmark-pisteet ole saaneet ulkopuolista vahvistusta. Pidä tämä mielessä, ennen kuin teet ostopäätöksiä yhden demon perusteella.

Sanasto

Kerneli (GPU-ydin)
Pieni ohjelmanpätkä, joka käskee näytönohjainta suorittamaan tietyn laskutehtävän tuhansilla rinnakkaisilla ytimillä yhtä aikaa. Tekoälymallien nopeus riippuu siitä, miten tehokkaita kernelit ovat.
Konteksti-ikkuna
Tekstimäärä jonka kielimalli pystyy pitämään muistissaan yhdellä kertaa. Miljoonan tokenin ikkuna vastaa noin kahtatuhatta sivua tekstiä.
Token
Tekstin perusyksikkö jonka kielimalli käsittelee ja jonka mukaan käyttö hinnoitellaan. Yksi token on noin puoli suomenkielistä sanaa.

Suurin kysymys ei ole, toistuuko temppu yleisellä raudalla, vaan kestääkö pitkä autonominen ajo silloin, kun tehtävä ei ole tarkasti rajattu yhden kernelin optimointiin. Avoin demo on aina helpompi kuin oikea asiakasprojekti. Mutta jos Qwen3.7 Max selviää myös sotkuisemmasta työstä puolikkaalla hinnalla siitä, mitä Claude Opus 4.7 maksaa, suomalaisten ohjelmistotalojen toimitusjohtajat alkavat laskea konetta uudelleen jo ensi viikolla.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 4Datakeskukset Suomessa – hankkeet, sähkö ja vero
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.