Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Keskiviikko · 12. elokuuta 2026Iltapainos · klo 21Nro 40

Alibaba teki tänään sen, mitä se on luvannut kaksi viikkoa: Qwen-perheen ylin Max-luokan malli tuli ulos avoimin painoin. Kaksi biljoonaa neljäsataa miljardia parametria, joista yhdeksänkymmentäviisi miljardia laskee. Se on ylivoimaisesti suurin koskaan avoimena julkaistu kielimalli — ja samalla ensimmäinen, jonka kohdalla tämän lehden pitää sanoa lukijalle rehellisesti: tätä et aja kotona. Unslothin yhden bitin kvantisointi painaa viisisataakahdeksan gigatavua. Se ei ole kirjoitusvirhe. Siksi illan toiseksi tärkein uutinen on pienempi ja tärkeämpi. Saman perheen kaksikymmentäseitsemän miljardin tiheä malli on lähtölaskennassa ModelScopessa, ja japanilainen PC Watch ilmoittaa päivämääräksi lauantain. Se on se, joka mahtuu yhteen näytönohjaimeen — ja se on se, jota tämän lehden lukijat oikeasti ajavat. llama.cpp reagoi jättimalliin samana aamuna tavalla, joka ei näy otsikossa lainkaan: kvantisoinnin tärkeysmatriisi lakkasi käymästä läpi asiantuntijoita, joihin ei koskettu. Se on yhden rivin muutos, joka ratkaisee sen, onko biljoonaluokan sekoitusmallin kvantisointi tuntien vai vuorokausien työ. Monikielinen hakuvaihe tuotti tänään kaksi numeroon asti päätynyttä löydöstä, ja molemmat ovat sellaisia, joita englanninkielinen haku ei antanut. Japanilainen PC Watch uutisoi Qwenin avoimista painoista ennen kuin ne näkyivät läntisessä mediassa. Ja Norjan kansalliskirjasto julkisti maanantaina kielimalliperheen, jonka koulutusaineistossa on tekijänoikeussuojattua sanomalehtitekstiä — laillisesti, kollektiivisopimuksella, neljänkymmenenviiden miljoonan kruunun vuosikorvausta vastaan. Se on eurooppalaisin uutinen, jonka tämä lehti on pitkään aikaan kirjoittanut. Mini-PC-palstalla vuorossa oli tuhannen ja kahdentuhannen euron luokka. Toista iltaa peräkkäin luokka ei tuottanut kahta konetta, jotka täyttäisivät kaikki neljä valintakriteeriä — ja tänään illan Laitteisto-juttu kertoo, miksi. Muistin hinta nousee niin nopeasti, että näytönohjaimissa se näkyy neljänkymmenen prosentin hyppyinä ja minikoneissa siinä, että valmiit kokoonpanot katosivat hyllyltä ennakkomyyntiin.

512 asiantuntijaa · 11 aktiivista2,4 biljoonaa painoa · 95 miljardia laskeeGated DeltaNet → MoE ×3 · Gated Attention → MoE ×11 bitti = 508 GBkonteksti 262 144 → 1 010 000 tokenia

Alibaba · Qwen · 12.8.2026

Kaksi biljoonaa neljäsataa miljardia parametria avoimin painoin — ja yhden bitin kvantisointikin painaa viisisataakahdeksan gigatavua

Qwen3.8-2.4T-A95B on ensimmäinen Qwen-perheen Max-luokan malli, joka on julkaistu avoimena. Viisisataakaksitoista asiantuntijaa, joista yksitoista laskee, Gated DeltaNet -hybridi, konteksti 262 144 tokenia ja laajennettuna 1 010 000. Painot ovat Hugging Facessa nyt, GGUF-versiot samoin — ja kotikoneelle mikään niistä ei mahdu.

Lue pääjuttu →

Kaksi julkaisua, sama perhe2,4 Tsekoitusmalli1 bitti = 508 GBjulkaistu 12.8.27 Btiheä malli4 bittiä ≈ 16,2 GBluvattu 15.8.27 miljardia on 1,1 prosenttia 2,4 biljoonasta

Alibaba · ModelScope · lähtölaskenta

Sama perhe, lähes yhdeksänkymmentäkertaa pienempi — kahdenkymmenenseitsemän miljardin Qwen on lähtölaskennassa, ja se on se, jonka oikeasti ajat

Qwen3.8-27B on tiheä malli, joka mahtuu yhteen näytönohjaimeen. ModelScopessa on ennakkosivu lähtölaskennalla, ja japanilainen PC Watch ilmoittaa julkaisuhetkeksi lauantain 15. elokuuta kello 00.00. Painoja ei vielä ole — mutta kokoluokka on tiedossa, ja se ratkaisee ostopäätöksiä jo tänään.

Lue juttu →

Kalibrointiajo: mitä tarkistetaanennen: kaikkinyt: vain kosketetutäärellisyystarkistus siirtyi kalibroinnin jälkeen512 asiantuntijaa · 11 aktivoituu tokenia kohtikoskematon asiantuntija ei ole virhe — se on vain koskematon

llama.cpp b10373 · vetopyyntö 26861

Tärkeysmatriisi lakkasi käymästä läpi asiantuntijoita, joihin ei koskettu — ja se on juuri se korjaus, jota biljoonamalli tarvitsi

Tänään aamulla julkaistu build muuttaa imatrix-työkalun tarkistuslogiikkaa: äärellisyystarkistus siirtyi ja se tehdään vain niille asiantuntijoille, joita kalibrointiaineisto oikeasti aktivoi. Viidensadankahdentoista asiantuntijan mallissa se on eri asia kuin kahdeksan asiantuntijan mallissa.

Lue juttu →

KV-välimuisti kontekstin kasvaessailman liukuvaa ikkunaaliukuva ikkuna päälläkonteksti kasvaa →kuva on havainnollistus, ei mittaus

llama.cpp b10361 · vetopyyntö 26848

LG:n mallia ajettiin väärin kuukausia — liukuva ikkuna ei ollut päällä, ja se näkyi muistissa eikä virheilmoituksessa

Build b10361 kytkee liukuvan ikkunan tarkkaavaisuuden päälle EXAONE 4.5 -malleille. Kyse ei ole kaatumisesta vaan hiljaisesta väärinkonfiguraatiosta: malli toimi, mutta söi pitkillä konteksteilla moninkertaisen määrän muistia siihen nähden, mitä sen arkkitehtuuri lupaa.

Lue juttu →

sanomalehdettekijänoikeusvoimassaKopinor-sopimus45 M NOKvuodessaBorealisavoimet painotviikko 34bokmål ja nynorsk · saame vielä työn allaei raapimista — ostettu aineistoHugging Face · NbAiLab

Norjan kansalliskirjasto · 10.8.2026

Norja koulutti kielimallinsa tekijänoikeussuojatulla sanomalehtitekstillä — ja maksoi siitä neljäkymmentäviisi miljoonaa kruunua vuodessa

Kansalliskirjaston Borealis-mallit bokmålille ja nynorskille tulevat Hugging Faceen viikolla 34. Uutinen ei ole malli vaan sopimus: aineisto on lisensoitu Kopinorin kollektiivisopimuksella, ja valtion budjetissa on oma rivi oikeudenhaltijoiden korvauksille.

Lue juttu →

Artificial Analysis -indeksiMuse Spark 1.257Qwen3.6 27B38Muse Glimmer35Nemotron 3.5 L24Llama 4 Maverick14Muse Glimmerin hallusinaatioaste 82 % · Qwen3.6 27B 49 %Intelligence Index v4.1.1 · yhdeksän arviota

Artificial Analysis · 10.–11.8.2026

Riippumaton mittaus kahdesta viime päivien avoimesta mallista — ja toinen niistä hallusinoi neljä kertaa viidestä

Artificial Analysis ajoi oman indeksinsä sekä Metan Muse Glimmerille että Nvidian Nemotron 3.5 Lightningille. Tulokset ovat 35 ja 24 pistettä. Kiinnostavin luku ei kuitenkaan ole kummankaan pistemäärä vaan Muse Glimmerin 82 prosentin hallusinaatioaste.

Lue juttu →

Mediaanihinta Neweggissä, USDkesäkuuelokuu5060 Ti 16 GB5708055070660900506037047016 GB VRAM: 35,6 → 50,3 dollaria gigatavultaYhdysvaltain verkkokauppojen mediaaneja, ei EU-hintoja

Tom's Hardware · hintakartoitus 10.8.2026

Halvin tapa saada kuusitoista gigatavua näytönmuistia kallistui neljäkymmentäyksi prosenttia kahdessa kuukaudessa

RTX 5060 Ti 16 GB nousi Neweggin mediaanihinnassa 570 dollarista 805 dollariin, RTX 5070 660:stä 900:aan. Syy on GDDR7-muistin hinta, jota tekoälykysynnän aiheuttama muistipula nostaa — ja sama pula näkyy tämän numeron mini-PC-palstalla.

Lue juttu →

Hinta laski, tokenit lisääntyivätluvattu 1.9. alkaen$3 / $15peruttujää voimaan$2 / $10pysyväSonnet 4.6: 100 tokeniaSonnet 5: noin 130 tokenia samasta tekstistäkonteksti 1 000 000 · uloste enintään 128 000

Anthropic · Claude Sonnet 5

Syyskuun hinnankorotus peruttiin — mutta uusi tokenisaattori syö suuren osan säästöstä

Claude Sonnet 5:n lanseeraushinta kaksi ja kymmenen dollaria miljoonalta tokenilta jää pysyväksi; luvattu nousu kolmeen ja viiteentoista jää tulematta. Sama dokumentaatio kertoo kuitenkin, että malli tuottaa samasta tekstistä noin kolmekymmentä prosenttia enemmän tokeneita kuin edeltäjänsä.

Lue juttu →

Teksti → puhe, ilman näytönohjaintatekstimtmd-kehyspocket-ttsCC-BY-4.0transponoidut konvoluutiot → GEMM ja col2im−80 % CUDA · −50 % CPUaika kehystä kohti · korrelaatio 0,999994malli on niin pieni, ettei GPU nopeuta sitä

llama.cpp b10369 · vetopyyntö 26871

Puhesynteesi, joka mahtuu taskuun — Kyutain pocket-tts sai tuen llama.cpp:hen, ja se ajetaan suorittimella

Kyutai Labsin pocket-tts on tekstistä puheeksi -malli, joka on niin pieni, ettei näytönohjain nopeuta sitä lainkaan. Nyt se on llama.cpp:n multimodaalisessa mtmd-kehyksessä. Lisenssi on CC-BY-4.0, ja sama malli pyörii selaimessa WebAssemblynä.

Lue juttu →

Kaksi sallittua ulostuloakysymystieto on tekstissävastaa lainatentietoa ei oleEI TIETOAkolmatta vaihtoehtoa ei olemerkkijono on tarkka, jotta ohjelma voi tunnistaa sen

Päivän promptivinkki

Anna pienelle mallille nimetty pakotie — se ei kieltäydy vastaamasta, ellet kerro sille tarkkaa sanaa, jolla kieltäydytään

Illan Benchmarkit-palstalla riippumaton mittaaja antoi kolmenkymmenen miljardin mallille 82 prosentin hallusinaatioasteen. Luku ei kerro, että malli valehtelee, vaan että se ei tiedä olevansa oikeutettu vaikenemaan. Korjaus on kaksi riviä kehotteessa.

Lue juttu →

mlx-audio 0.4.8TTSSTTdiarisaatioVADyksi API · OpenAI-yhteensopiva palvelin · MLXiSTFTNet-vokooderin korjausennen: −2,5 dBnyt: oikea taso

Päivän Python-kirjasto

mlx-audio 0.4.8: koko puhepino yhdellä API:lla — ja korjaus, joka nosti äänen tason kaksi ja puoli desibeliä takaisin

Kymmenentenä elokuuta julkaistu versio kokoaa tekstistä puheeksi, puheentunnistuksen, diarisaation ja äänenparannuksen samaan pakettiin Apple Siliconille. Kiinnostavin muutos on kolme vokooderin bugia, joista yksi vaimensi kaiken äänen huomaamatta.

Lue juttu →

Uusi sukupolvi vastaan vanha hintaASUS NUC 16 Pro1 962 €Panther Lake · 28 dB · 115,2 GB/sGeekom GT1 Mega849 €Meteor Lake · 34,1 dB · 89,6 GB/smolemmissa 32 GB vaihdettavaa DDR5:tä2732Algoritmi-luku · hinta voittaa kaistan ja hiljaisuuden

Mini-PC-vertailu · vuorossa ollut luokka: 1000–2000 €

Kaksi vuotta kehitystä maksaa tuhat sata euroa — ja tämän lehden indeksi sanoo, ettei se kannata

Vastakkain ASUSin aivan uusi Panther Lake -NUC ja Geekomin kaksi vuotta vanha Meteor Lake -kone. Uudempi on nopeampi muistiltaan ja kuusi desibeliä hiljaisempi. Se maksaa myös 2,3-kertaisesti, ja Algoritmi-luku menee vanhemmalle koneelle.

Lue juttu →

Leikepöytä ei poistu koneeltakoneen rajakopioitutekstiPhi SilicaNPUliitäei rajapinta-avainta · ei Ollamaa · ei pilveäehto: Copilot+ PC, jossa on NPUesiversio 0.101.2211.0 · vakaa yhä 0.100.2

Microsoft · PowerToys 0.101.2211.0

Windows sai leikepöydälle paikallisen mallin — Phi Silica ajaa NPU:lla, eikä pyydä rajapinta-avainta

PowerToysin esiversio lisää Microsoftin oman laitteella ajettavan mallin Advanced Pasten tarjoajaksi. Kehote ja tulos pysyvät koneella, mutta ehto on kova: tarvitset Copilot+ PC:n NPU:lla. Vakaa versio on yhä 0.100.2.

Lue juttu →

Kokeilemisen arvoista

Katso paljonko illan jättimalli vaatii, hae imatrix-korjattu build ja asenna päivän puhepino

Kolme komentoa tämän vuorokauden julkaisuista. Ensimmäinen ei lataa mitään — se listaa Unslothin GGUF-varaston tiedostokoot, ja se on illan opettavaisin komento, koska luvut näkyvät ennen kuin levy täyttyy. Toinen hakee llama.cpp:n aamuisen buildin, jossa on tärkeysmatriisin asiantuntijakorjaus. Kolmas asentaa päivän Python-kirjaston.

curl -s https://huggingface.co/api/models/unsloth/Qwen3.8-2.4T-A95B-GGUF | python3 -m json.tool | head -40
curl -LO https://github.com/ggml-org/llama.cpp/releases/download/b10373/llama-b10373-bin-ubuntu-x64.tar.gz
pip install "mlx-audio==0.4.8" misaki

Ensimmäinen komento kysyy Hugging Facen rajapinnalta, mitä varastossa on, eikä lataa painoja. Varaston oma laitteistoyhteensopivuustaulukko kertoo kolme lukua: yhden bitin UD-IQ1_S vie 508 gigatavua, kahdeksan bitin Q8_0 vie 2,6 teratavua ja BF16 vie 4,89 teratavua. Nämä eivät ole muistivaatimuksia vaan tiedostokokoja — muistia tarvitaan vielä hieman enemmän. Toinen komento hakee buildin b10373; siinä ei ole uusia ominaisuuksia, mutta se on ensimmäinen, jossa tärkeysmatriisin laskenta ei enää käy läpi asiantuntijoita, joihin kalibrointiaineisto ei koskenut. Kolmas komento asentaa mlx-audion, joka toimii vain Apple Siliconilla — Linuxilla tai NVIDIA-koneella se asentuu mutta ei aja mitään. Kokoro tarvitsee lisäksi misaki-fonemisaattorin, joka on tässä samassa komennossa, ja MP3-tallennus tarvitsee ffmpegin erikseen.