Tekoälyn päivälehti — mallit, työkalut ja hardware
Keskiviikko · 12. elokuuta 2026Iltapainos · klo 21Nro 40
Alibaba teki tänään sen, mitä se on luvannut kaksi viikkoa: Qwen-perheen ylin Max-luokan malli tuli ulos avoimin painoin. Kaksi biljoonaa neljäsataa miljardia parametria, joista yhdeksänkymmentäviisi miljardia laskee. Se on ylivoimaisesti suurin koskaan avoimena julkaistu kielimalli — ja samalla ensimmäinen, jonka kohdalla tämän lehden pitää sanoa lukijalle rehellisesti: tätä et aja kotona. Unslothin yhden bitin kvantisointi painaa viisisataakahdeksan gigatavua. Se ei ole kirjoitusvirhe.
Siksi illan toiseksi tärkein uutinen on pienempi ja tärkeämpi. Saman perheen kaksikymmentäseitsemän miljardin tiheä malli on lähtölaskennassa ModelScopessa, ja japanilainen PC Watch ilmoittaa päivämääräksi lauantain. Se on se, joka mahtuu yhteen näytönohjaimeen — ja se on se, jota tämän lehden lukijat oikeasti ajavat.
llama.cpp reagoi jättimalliin samana aamuna tavalla, joka ei näy otsikossa lainkaan: kvantisoinnin tärkeysmatriisi lakkasi käymästä läpi asiantuntijoita, joihin ei koskettu. Se on yhden rivin muutos, joka ratkaisee sen, onko biljoonaluokan sekoitusmallin kvantisointi tuntien vai vuorokausien työ.
Monikielinen hakuvaihe tuotti tänään kaksi numeroon asti päätynyttä löydöstä, ja molemmat ovat sellaisia, joita englanninkielinen haku ei antanut. Japanilainen PC Watch uutisoi Qwenin avoimista painoista ennen kuin ne näkyivät läntisessä mediassa. Ja Norjan kansalliskirjasto julkisti maanantaina kielimalliperheen, jonka koulutusaineistossa on tekijänoikeussuojattua sanomalehtitekstiä — laillisesti, kollektiivisopimuksella, neljänkymmenenviiden miljoonan kruunun vuosikorvausta vastaan. Se on eurooppalaisin uutinen, jonka tämä lehti on pitkään aikaan kirjoittanut.
Mini-PC-palstalla vuorossa oli tuhannen ja kahdentuhannen euron luokka. Toista iltaa peräkkäin luokka ei tuottanut kahta konetta, jotka täyttäisivät kaikki neljä valintakriteeriä — ja tänään illan Laitteisto-juttu kertoo, miksi. Muistin hinta nousee niin nopeasti, että näytönohjaimissa se näkyy neljänkymmenen prosentin hyppyinä ja minikoneissa siinä, että valmiit kokoonpanot katosivat hyllyltä ennakkomyyntiin.
Qwen3.8-2.4T-A95B on ensimmäinen Qwen-perheen Max-luokan malli, joka on julkaistu avoimena. Viisisataakaksitoista asiantuntijaa, joista yksitoista laskee, Gated DeltaNet -hybridi, konteksti 262 144 tokenia ja laajennettuna 1 010 000. Painot ovat Hugging Facessa nyt, GGUF-versiot samoin — ja kotikoneelle mikään niistä ei mahdu.
Qwen3.8-27B on tiheä malli, joka mahtuu yhteen näytönohjaimeen. ModelScopessa on ennakkosivu lähtölaskennalla, ja japanilainen PC Watch ilmoittaa julkaisuhetkeksi lauantain 15. elokuuta kello 00.00. Painoja ei vielä ole — mutta kokoluokka on tiedossa, ja se ratkaisee ostopäätöksiä jo tänään.
Tänään aamulla julkaistu build muuttaa imatrix-työkalun tarkistuslogiikkaa: äärellisyystarkistus siirtyi ja se tehdään vain niille asiantuntijoille, joita kalibrointiaineisto oikeasti aktivoi. Viidensadankahdentoista asiantuntijan mallissa se on eri asia kuin kahdeksan asiantuntijan mallissa.
Build b10361 kytkee liukuvan ikkunan tarkkaavaisuuden päälle EXAONE 4.5 -malleille. Kyse ei ole kaatumisesta vaan hiljaisesta väärinkonfiguraatiosta: malli toimi, mutta söi pitkillä konteksteilla moninkertaisen määrän muistia siihen nähden, mitä sen arkkitehtuuri lupaa.
Kansalliskirjaston Borealis-mallit bokmålille ja nynorskille tulevat Hugging Faceen viikolla 34. Uutinen ei ole malli vaan sopimus: aineisto on lisensoitu Kopinorin kollektiivisopimuksella, ja valtion budjetissa on oma rivi oikeudenhaltijoiden korvauksille.
Artificial Analysis ajoi oman indeksinsä sekä Metan Muse Glimmerille että Nvidian Nemotron 3.5 Lightningille. Tulokset ovat 35 ja 24 pistettä. Kiinnostavin luku ei kuitenkaan ole kummankaan pistemäärä vaan Muse Glimmerin 82 prosentin hallusinaatioaste.
RTX 5060 Ti 16 GB nousi Neweggin mediaanihinnassa 570 dollarista 805 dollariin, RTX 5070 660:stä 900:aan. Syy on GDDR7-muistin hinta, jota tekoälykysynnän aiheuttama muistipula nostaa — ja sama pula näkyy tämän numeron mini-PC-palstalla.
Claude Sonnet 5:n lanseeraushinta kaksi ja kymmenen dollaria miljoonalta tokenilta jää pysyväksi; luvattu nousu kolmeen ja viiteentoista jää tulematta. Sama dokumentaatio kertoo kuitenkin, että malli tuottaa samasta tekstistä noin kolmekymmentä prosenttia enemmän tokeneita kuin edeltäjänsä.
Kyutai Labsin pocket-tts on tekstistä puheeksi -malli, joka on niin pieni, ettei näytönohjain nopeuta sitä lainkaan. Nyt se on llama.cpp:n multimodaalisessa mtmd-kehyksessä. Lisenssi on CC-BY-4.0, ja sama malli pyörii selaimessa WebAssemblynä.
Illan Benchmarkit-palstalla riippumaton mittaaja antoi kolmenkymmenen miljardin mallille 82 prosentin hallusinaatioasteen. Luku ei kerro, että malli valehtelee, vaan että se ei tiedä olevansa oikeutettu vaikenemaan. Korjaus on kaksi riviä kehotteessa.
Kymmenentenä elokuuta julkaistu versio kokoaa tekstistä puheeksi, puheentunnistuksen, diarisaation ja äänenparannuksen samaan pakettiin Apple Siliconille. Kiinnostavin muutos on kolme vokooderin bugia, joista yksi vaimensi kaiken äänen huomaamatta.
Vastakkain ASUSin aivan uusi Panther Lake -NUC ja Geekomin kaksi vuotta vanha Meteor Lake -kone. Uudempi on nopeampi muistiltaan ja kuusi desibeliä hiljaisempi. Se maksaa myös 2,3-kertaisesti, ja Algoritmi-luku menee vanhemmalle koneelle.
PowerToysin esiversio lisää Microsoftin oman laitteella ajettavan mallin Advanced Pasten tarjoajaksi. Kehote ja tulos pysyvät koneella, mutta ehto on kova: tarvitset Copilot+ PC:n NPU:lla. Vakaa versio on yhä 0.100.2.
Katso paljonko illan jättimalli vaatii, hae imatrix-korjattu build ja asenna päivän puhepino
Kolme komentoa tämän vuorokauden julkaisuista. Ensimmäinen ei lataa mitään — se listaa Unslothin GGUF-varaston tiedostokoot, ja se on illan opettavaisin komento, koska luvut näkyvät ennen kuin levy täyttyy. Toinen hakee llama.cpp:n aamuisen buildin, jossa on tärkeysmatriisin asiantuntijakorjaus. Kolmas asentaa päivän Python-kirjaston.
Ensimmäinen komento kysyy Hugging Facen rajapinnalta, mitä varastossa on, eikä lataa painoja. Varaston oma laitteistoyhteensopivuustaulukko kertoo kolme lukua: yhden bitin UD-IQ1_S vie 508 gigatavua, kahdeksan bitin Q8_0 vie 2,6 teratavua ja BF16 vie 4,89 teratavua. Nämä eivät ole muistivaatimuksia vaan tiedostokokoja — muistia tarvitaan vielä hieman enemmän. Toinen komento hakee buildin b10373; siinä ei ole uusia ominaisuuksia, mutta se on ensimmäinen, jossa tärkeysmatriisin laskenta ei enää käy läpi asiantuntijoita, joihin kalibrointiaineisto ei koskenut. Kolmas komento asentaa mlx-audion, joka toimii vain Apple Siliconilla — Linuxilla tai NVIDIA-koneella se asentuu mutta ei aja mitään. Kokoro tarvitsee lisäksi misaki-fonemisaattorin, joka on tässä samassa komennossa, ja MP3-tallennus tarvitsee ffmpegin erikseen.