Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Keskiviikko · 26. elokuuta 2026Iltapainos · klo 21Nro 54

Keskiviikko oli avoimien painojen päivä, ja poikkeuksellisesti kaksi kertaa. Alibaba avasi Qwen3.8-Flash-Nextin — 125 miljardin parametrin asiantuntijamallin, jonka rinnalla kulkee 51 miljardin parametrin hakutaulukko, joka on suunniteltu pidettäväksi keskusmuistissa eikä näytönohjaimella. Muutamaa tuntia myöhemmin Zhipu julkaisi GLM-5.3-Flashin MIT-lisenssillä: 320 miljardia parametria, joista 18 aktiivisena, ja ensimmäistä kertaa GLM-sarjassa natiivisti monimuotoinen. Ohjelmistopuoli reagoi saman vuorokauden sisällä: Hugging Facen transformers julkaisi kaksi versiota kolmentoista minuutin välein, Ollama sai Qwenin uuden arkkitehtuurin MLX-taustalle, ja KTransformers lisäsi GLM:lle oman ajopolkunsa. Lisäksi: yksi kehittäjä siirsi Qwenin 51 miljardin taulukon SSD-levylle, Perplexity julkaisi agentistaan version joka ei ota yhteyttä mihinkään, Nvidia esitteli 78 TOPSin reunatietokoneen — ja mini-PC-palstalla 32 gigatavua hidasta muistia kohtaa 16 gigatavua nopeaa.

Mallit · avoimet painot · asiantuntijamalli

Qwen avasi mallin, jonka puolet painoista on tarkoitus pitää keskusmuistissa — 51 miljardia parametria hakutaulukkona

Qwen3.8-Flash-Next on 125 miljardin parametrin asiantuntijamalli, jossa on kerrallaan aktiivisena kuusi miljardia. Sen rinnalla kulkee 51 miljardin parametrin taulukko, joka ei ole laskentaa vaan hakemista — ja jonka Qwen sanoo suoraan olevan tarkoitettu siirrettäväksi pois kiihdyttimen muistista. Kvantit ilmestyivät samana iltapäivänä.

Lue pääjuttu →

Suljetut · lisenssit · pilvihinnoittelu

Painot ovat ilmaiset, mutta juuri se tuote jota olit tekemässä vaatii sopimuksen — Qwenin lisenssin pieni präntti

Qwen3.8-Flash-Next julkaistiin Qwen Community License 1.0:lla, ei Apache 2.0:lla. Kaupallinen käyttö on lähtökohtaisesti maksutonta, mutta mallin myyminen palveluna sekä tuotteet, joiden pääasia on koodiavustaminen tai toimistotyö, vaativat erillisen sopimuksen. Sama malli myydään pilvestä 0,16 dollarilla miljoonalta syötetokenilta.

Lue juttu →

Mini-PC-vertailu · alle 1 000 euron luokka · budget mini-PC

Kaksinkertainen muisti kohtasi puolitoistakertaisen väylän — Minisforum AI X1 vastaan GMKtec NucBox K13

Toisessa on 32 gigatavua muistia, jota luetaan 89,6 gigatavun sekuntivauhtia. Toisessa on 16 gigatavua, jota luetaan 136,5 gigatavun vauhtia. Ensimmäinen käynnistää mallit, joita toinen ei saa auki lainkaan; toinen ajaa mahtuvat mallit puolitoista kertaa nopeammin ja on levossa äänetön. Hintaeroa on 139 euroa.

Lue juttu →

Kokeilemisen arvoista

Kolme komentoa illan jutuista

Ensimmäinen päivittää ajomoottorin, joka oppi tänään illan pääjutun arkkitehtuurin. Toinen hakee saman mallin nelibittiset kvantit, jotka ilmestyivät muutama tunti painojen jälkeen. Kolmas lataa Media-palstan puhesyntetisaattorin, joka osaa suunnitella äänen pelkän sanallisen kuvauksen perusteella.

ollama --version && ollama pull qwen3.8-flash-next
hf download unsloth/GLM-5.3-Flash-GGUF --include '*Q4_K_M*' --local-dir glm53-flash
hf download BreezeBlue/Breeze-TTS-2 --local-dir breeze-tts-2

Ensimmäinen komento vaatii Ollaman version 0.33.1 tai uudemman, ja uusi arkkitehtuuri kulkee toistaiseksi MLX-taustan kautta — eli käytännössä Applen piireillä. Toinen lataa GLM-5.3-Flashin nelibittisen kvantin, ja on syytä katsoa tiedostokoot ennen kuin painaa enteriä: 320 miljardin parametrin mallista jää nelibittisenäkin noin 190 gigatavua, joka jaetaan useaan osatiedostoon. Kolmas hakee kolmen ja puolen miljardin parametrin puhemallin painot; ajokoodi on erikseen projektin GitHub-repossa, ja painojen lisenssi rajaa käytön tutkimukseen ja ei-kaupalliseen tekemiseen, vaikka itse koodi on Apache 2.0:n alla. Kaikki hf-komennot tulevat huggingface_hub-paketista (pip install -U huggingface_hub).