Alibaba julkaisi viime viikolla Qwen3.7 Max -kielimallin ja osoitti sen voiman epätavallisella demolla. Malli sai eteensä tuntemattoman GPU-sirun ja tehtävän: optimoi yksi sen ydinkerneleistä. Yhtäjaksoisen 35 tunnin työrupeaman jälkeen kerneli pyöri kymmenen kertaa nopeammin kuin alkuperäinen Triton-toteutus.
35 tuntia, 1 158 työkalukutsua, 432 kernelitestiä
Demon kohteena oli ZW-M890 PPU, sirupakkaus, jota Qwen3.7 Maxin koulutusdatassa ei ollut. Mallilla ei ollut käytössään valmistajan dokumentaatiota, profilointityökaluja eikä esimerkkikoodia. Sen piti ensin selvittää, miten siru toimii, sitten kirjoittaa profilointi-, debug- ja vertailurutiinit, ja lopulta iteroida kernelin nopeutta ylöspäin.
Mittauksen mukaan malli teki 1 158 erillistä työkalukutsua ja ajoi kernelin 432 kertaa korjausten välissä. Yhteensä yli puolitoista vuorokautta yhtenäistä optimointistrategiaa, jonka kaikki välivaiheet pysyivät yhden konteksti-ikkunan sisällä. Ikkunan koko on miljoona tokenia, karkeasti kaksituhatta sivua tekstiä.
Tuntematon siru, kymmenkertainen nopeus
Lopputulos: geometrisesti keskimäärin 10× nopeampi Extend Attention -kerneli kuin Triton-referenssissä. Luku on merkityksellinen siksi, että Triton on tällä hetkellä standardi tapa kirjoittaa GPU-ytimiä Pythonista käsin. Jos kielimalli pystyy iteroimaan kymmenkertaiseen tehoon ilman ihmistä, sirujen ohjelmistosuunnittelun pullonkaula alkaa siirtyä toiseen paikkaan.
Qwen3.7 Max ei ole vain yhden tehtävän malli. SWE-Bench Pro -mittarissa Alibaba ilmoittaa pisteeksi 60,6 prosenttia, jolla se kiilaa Claude Opus 4.6:n 57,3 prosentin edelle. Terminal-Bench 2.0 antoi 69,7 prosenttia ja MCP-Atlas 76,4 prosenttia. Numerot ovat valmistajan ilmoittamia ja odottavat riippumatonta vahvistusta.
SWE-Bench Pro – ohi Claude Opus 4.6:n (57,3 %)
Terminal-Bench 2.0
MCP-Atlas (työkalukutsut)
Yhtäjaksoinen autonominen koodaus
Swap-vaihto Claude Codeen kolmella muuttujalla
Käytännön merkitys suomalaiselle kehittäjälle tiivistyy yhteen tekniseen yksityiskohtaan: Qwen3.7 Max puhuu natiivisti Anthropicin API-protokollaa. Jos käytät Claude Codea terminaalissa, vaihto Alibaban malliin onnistuu kolmella ympäristömuuttujalla. Base URL, API-avain ja mallin nimi osoittavat DashScope-palvelimelle, eikä itse Claude Codeen tarvitse koskea muuten.
Hinnoittelu on aggressiivinen. Sisääntuleva token maksaa 2,50 dollaria miljoonalta, ulostuleva 7,50 dollaria, välimuistitettu sisääntulo 0,25 dollaria. Tämä tekee Qwen3.7 Maxista noin kuusi kertaa halvemman kuin Claude Opus 4.7 syötteen osalta. Pitkissä agenttitehtävissä, joissa konteksti-ikkuna täyttyy nopeasti, ero kertautuu kuukausilaskussa.



