Tekoälyn päivälehti — mallit, työkalut ja hardware
Intel · oneAPI ja SYCL · työasemakortti · Alustat
Guangzhoun työpajassa Intel näytti Arc Pro B70:llä työnkulun, jossa avoimen painon videomalli, kielimalli ja editointi pyörivät samalla koneella ilman pilveä. Luku on Intelin oma, ja se on kaksi ja puoli kertaa suurempi kuin riippumattomat mittaukset samasta kortista.
Intelin Arc Pro B70 on ollut myynnissä maaliskuusta asti, ja sen myyntiargumentti on yksi luku: 32 gigatavua näyttömuistia 949 dollarilla. Se on halvin 32 gigatavun erillinen näytönohjain, ja paikallisen mallin ajajalle muistin määrä ratkaisee sen, mikä malli ylipäätään mahtuu — kaista, 608 gigatavua sekunnissa, ratkaisee sen, kuinka nopeasti se vastaa.
Lauantaina kortista tuli kiinalaismedian kautta uusi luku. Intel piti Guangzhoussa työpajan yhdessä MiniMaxin ja studio 数字折叠:n kanssa ja esitteli täysin paikallisen tekoälyvideon tuotantoketjun, jossa kaikki vaiheet ajetaan yhdellä koneella. Kielimallipuolen luku on tarkka: B70 ajaa Qwen3.8-27B:tä nelibittisellä Q4_K_M-pakkauksella ja luonnostelupää päällä 52 tokenia sekunnissa 256 000 tokenin kontekstilla.
Luku kannattaa lukea rinnan aiempien kanssa. Riippumattomissa mittauksissa sama kortti ajaa edellisen sukupolven 27 miljardin mallia noin 14 tokenia sekunnissa Vulkanilla ja 22 SYCL-polulla. Intelin 52 on siis runsaat kaksi kertaa nopeampi kuin paras aiempi julkinen luku — ja ero selittyy ainakin osittain sillä, että mukana on mallin oma luonnostelupää, joka arvaa useita tokeneita kerralla, sekä Intelin oma ohjelmistopino. Se ei tee luvusta väärää, mutta se ei ole sama koe.
Muu esittely oli videopuolella. Kortti sai päivän nolla -tuen avoimen painon MiniMax H3 -videomallille, ja Intelin mukaan yhden, kahden tai neljän kortin klusterilla voi ajaa yli 100 miljardin parametrin malleja. Studio 数字折叠 demosi 720p-videon paikallista generointia ja tarkkuuden nostoa 1080p–2K-tasolle, ja kertoi tuotantoketjunsa kutistuneen yli 20 solmusta kolmeen.
Intelin päätelaite-tekoälyn osaamiskeskusta vetävä Xiong Yue perusteli linjan taloudella: kertaluonteinen paikallisinvestointi tulee pitkällä aikavälillä halvemmaksi kuin per generointi laskutettava pilvi, eikä jonoja ole. Argumentti on tuttu, mutta 32 gigatavun kortin hinnassa se on ensimmäistä kertaa lähellä totta myös harrastajalle — AMD:n vastaava 32 gigatavun kortti maksaa noin 250 dollaria enemmän.