Tekoäly

Intel haastaa Nvidian puoleen hintaan

Arc Pro B70 tuo 32 gigatavua 949 dollarilla – riittääkö se kielimalleihin?

Aino AikajärviAino Aikajärvi
Jaa:
Intel haastaa Nvidian puoleen hintaan

Intel julkaisi tällä viikolla Arc Pro B70 -näytönohjaimen. Kortti tarjoaa 32 gigatavua muistia 949 dollarin hintaan, mikä tekee siitä noin puolet halvemman kuin Nvidian vastaava RTX Pro 4000. Kyse ei ole pelikortista vaan ammattilaistuotteesta, joka on suunnattu tekoälyn paikalliseen ajamiseen.

Hintaero on merkittävä. Kun Nvidian ammattikortit maksavat tyypillisesti yli 1 500 dollaria, Intel tarjoaa enemmän muistia alle tuhannella. Yhtiön mukaan B70 tuottaa kaksi kertaa enemmän tokeneita dollarilla kuin kilpailija.

Intel julkaisi samalla myös edullisemman Arc Pro B65 -mallin, mutta sarjan lippulaiva on B70, joka tähtää suoraan Nvidian ammattikorttimarkkinoiden ytimeen.

Battlemagen tekniikka

Arc Pro B70 perustuu Intelin Battlemage-arkkitehtuuriin ja BMG-G31-piiriin, joka valmistetaan TSMC:n viiden nanometrin prosessilla. Kortissa on 32 Xe2-ydintä, 256 XMX-tekoälymoottoria ja kellotaajuus yltää 2 800 megahertsiin.

Muistia on 32 gigatavua GDDR6-tyyppiä 256-bittisellä väylällä, ja muistikaistaa kertyy 608 gigatavua sekunnissa. Tekoälylaskennan INT8-teho on 367 TOPS, liukulukulaskennan FP32-teho 22,9 teraflopsia. Referenssimallin tehonkulutus on 230 wattia.

Puolet hinnasta, kolmannes enemmän muistia

Intelin omien testien mukaan B70 saavuttaa 2,2-kertaiset konteksti-ikkunat verrattuna Nvidian RTX Pro 4000 -korttiin. Moniajotyökuormissa tokenituotto on 85 prosenttia korkeampi, ja monen agentin käyttötapauksissa ensimmäinen vastaus tulee jopa 6,2 kertaa nopeammin. Testit ajettiin Ministral Instruct 2410 8B -mallilla.

Riippumattomat testit antavat tasaisemman kuvan. Level1Techs testasi neljän kortin kokoonpanoja Qwen 3.5 27B -mallilla: neljä B70-korttia saavutti 369–550 tokenia sekunnissa, kun neljä RTX 3090 -korttia pääsi 348 tokeniin. Yhdellä kortilla RTX 3090 on kuitenkin nopeampi, koska sen muistikaista on selvästi leveämpi – 936 gigatavua sekunnissa vastaan B70:n 608.

Mitä 32 gigalla oikeasti pyörittää?

Muistikapasiteetti on ratkaiseva tekijä kielimallien paikallisessa ajamisessa. Tavallisten pelikorttien 8–16 gigatavua rajoittaa käytettävien mallien kokoa, mutta B70:n 32 gigatavulla tilanne muuttuu.

Qwen 3.5 27B -malli toimii Q6- tai jopa Q8-kvantisoinnilla ilman muistin ylivuotoa. Llama 3.1 70B mahtuu 4-bittisellä kvantisoinnilla, ja pienempiä malleja kuten Mistral 7B tai Llama 3.1 8B pyörittää pitkillä konteksteilla vaivatta. 70 miljardin parametrin malli riittää jo vaativiin tehtäviin kuten koodin tuottamiseen ja pitkien dokumenttien analysointiin.

Kehittäjälle tai pienelle yritykselle tämä tarkoittaa mahdollisuutta ajaa kielimallia omalla työasemalla ilman pilvipalvelun kuukausimaksuja. Neljän kortin kokoonpanolla voi palvella kymmeniä samanaikaisia käyttäjiä.

Sanasto

Tokeni
Tekstin perusyksikkö jonka kielimalli käsittelee kerrallaan. Yksi suomenkielinen sana on tyypillisesti 1–3 tokenia.
Kvantisointi
Kielimallin pakkausmenetelmä jossa mallin tarkkuutta lasketaan hallitusti pienemmän muistinkäytön saavuttamiseksi. Mitä pienempi bittiluku (esim. 4-bittinen), sitä kevyempi mutta epätarkempi malli.
Konteksti-ikkuna
Tekstimäärä jonka kielimalli pystyy käsittelemään kerralla, käytännössä mallin työmuisti. Isompi ikkuna mahdollistaa pidempien dokumenttien analysoinnin.

Yhden prosentin haastaja

Intel on näytönohjainmarkkinoilla marginaalinen toimija. Yhtiön osuus erillisistä näytönohjainmarkkinoista kipusi viime vuonna yhteen prosenttiin, kun Nvidia hallitsee 94 prosentin osuudella.

B70 paljastaa Intelin strategian: yhtiö ei yritä haastaa Nvidiaa pelaamisen saralla vaan keskittyy ammatti- ja tekoälykäyttöön. Siellä hinnoittelu ja muistikapasiteetti painavat enemmän kuin raakasuorituskyky. Intel on kertonut suunnitelmistaan laajentaa näytönohjainvalikoimaansa datakeskuksiin lähivuosina.

Suomessa halvempi tekoälylaitteisto hyödyttää erityisesti yrityksiä, jotka käsittelevät arkaluontoista dataa. AMD:n omistama suomalainen Silo AI on kehittänyt avoimia kielimalleja, joiden paikallinen ajaminen vaatii riittävästi muistia. B70:n kaltainen edullinen kortti voisi tehdä tällaisten mallien käytöstä arkipäiväisempää pienillekin yrityksille.

Nvidia ei menetä yöuniaan yhden prosentin haastajasta. Mutta jos Intel onnistuu vakuuttamaan kehittäjät siitä, että sama työ hoituu puoleen hintaan, kilpailuasetelma voi näyttää hyvin erilaiselta parin vuoden päästä.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.