Tekoälyn päivälehti — mallit, työkalut ja hardware
AMD · Day 0 · 14.8.2026 · Laitteisto
AMD julkaisi Qwen3.8-27B:lle päivä nollan tuen Ryzen AI Max+ -koneille ja Radeon AI PRO R9700 -kortille. Alustavat luvut ovat 24,5 ja 51,8 tokenia sekunnissa, ja ne mitattiin llama.cpp:n Vulkan-taustaosalla — testipenkkinä GMKtecin EVO-X2.
Kun Alibaba avasi Qwen3.8-27B:n painot torstaina, AMD:llä oli perjantaina valmiina paitsi tuki myös luvut. Yhtiön kehittäjäblogi julkaisi 14. elokuuta päivä nollan tukipaketin, jonka ydinviesti on suora: uusi 27 miljardin parametrin tiheä malli pyörii heti Ryzen AI Max+ -prosessorin koneilla ja yhdellä Radeon AI PRO R9700 -näytönohjaimella, avoimilla työkaluilla ja ilman odottelua.
Luvut ovat AMD:n omia ja yhtiö kutsuu niitä alustaviksi, mutta ne ovat silti ensimmäiset valmistajan julkaisemat mittaukset tästä mallista: enimmillään 24,5 tokenia sekunnissa Ryzen AI Max+ 395:llä ja 51,8 tokenia sekunnissa yhdellä R9700-kortilla. Mittaukset tehtiin Windowsilla, llama.cpp:n Vulkan-taustaosalla, ja tulos on vähintään kolmen ajon keskiarvo. Alaviitteistä paljastuu tämän lehden lukijoille tuttu yksityiskohta: Ryzen-mittausten testipenkki oli GMKtecin EVO-X2 -mini-PC 128 gigatavun muistilla, josta 64 gigatavua oli annettu näytönohjaimelle. Sama kone on esiintynyt tämän lehden sivuilla useasti kesän mittaan.
Kiinnostavin tekninen yksityiskohta on MTP eli monen tokenin ennustus. AMD ajoi mallia niin, että se luonnostelee useita tokeneita kerralla: Ryzen-koneella neljä ja R9700:lla kaksi. Sama säätö on tehtävä itse, jos haluaa AMD:n lukuja vastaavan nopeuden — LM Studiossa MTP kytketään päälle ja luonnostokenien määrä asetetaan käsin, ja lisäksi AMD neuvoo ottamaan mallin latausasetuksista Try mmap -valinnan pois. Tällaiset asetusohjeet ovat uutta: vielä keväällä day 0 -tuki tarkoitti lähinnä sitä, että malli ylipäätään latautui.
Muistivaatimus on syytä sanoa ääneen. AMD:n mukaan malli tarvitsee noin 24 gigatavua näytönohjaimen muistia tai jaettua muistia toimiakseen mukavasti. Se rajaa pelikortit käytännössä pois ja tekee mallista juuri sen kokoisen, että Strix Halo -koneet ja 32 gigatavun R9700 ovat sille luonteva koti. Kevyemmällä raudalla ajetaan pienempiä kvantisointeja tai pienempiä malleja.
Polkuja on kaksi. Kokeilijalle AMD suosittelee LM Studiota, josta mallin voi ladata ja jolla sen kanssa voi keskustella ilman riviäkään koodia. Sovelluskehittäjälle tarjotaan Lemonadea, AMD:n paikallisajon alustaa, joka paketoidaan sovelluksen kylkeen ja joka tarjoaa mallin OpenAI-yhteensopivan rajapinnan kautta — laitetunnistus ja taustaosan valinta hoituvat konepellin alla. Lemonade sai samana päivänä oman versiopäivityksensä, josta kerromme erikseen tämän numeron Työkalut-palstalla.
Datakeskuspuoli hoidettiin jo aiemmin: AMD julkaisi 12. elokuuta erillisen day 0 -ohjeen koko Qwen 3.8 -perheelle Instinct MI300X-, MI325X- ja MI355X-korteille SGLangin ja vLLM:n kanssa. Kotikoneen ja konesalin tuki samalta viikolta on merkki siitä, mihin suuntaan avointen mallien julkaisut ovat menossa: painot, ajomoottorit ja valmistajan mittaukset ilmestyvät päivien sisällä toisistaan, eikä paikallisajaja enää odota kuukausia ekosysteemin kypsymistä.
Varaukset lopuksi: kaikki illan luvut ovat AMD:n markkinointiosaston julkaisemia, eivät riippumattomia. Ne on mitattu tarkasti nimetyllä kokoonpanolla ja tuoreimmalla ajuripinolla, ja "up to" -sanapari on mukana jokaisessa. Suunta on silti selvä, ja kuka tahansa EVO-X2:n tai R9700:n omistaja voi toistaa mittauksen itse — ohjeet ja asetukset ovat blogissa poikkeuksellisen avoimesti esillä.