Tekoälyn päivälehti — mallit, työkalut ja hardware
Kuun viimeinen päivä toi vuoden odotetuimman avoimen painon julkaisun: DeepSeek avasi ensimmäisen näkevän mallinsa MIT-lisenssillä, ja tiedostot paljastavat siitä jotain, mitä tiedote ei kerro. Malli tulee ulos valmiiksi pakattuna — sen asiantuntijaosat on tallennettu neljällä bitillä jo tehtaalla, ja siksi yhteisön nelibittinen versio on vain neljä prosenttia pienempi kuin kahdeksanbittinen. Eteläkorealainen Nota AI puolestaan karsi GLM-5.3:sta joka kerroksesta eri määrän asiantuntijoita ja sai 753 miljardin parametrin mallin mahtumaan kahdelle näytönohjaimelle kahdeksan sijaan. llama.cpp:ssä oli sekin harvinainen päivä, jona sama korjaus tehtiin kolmelle eri näytönohjainrajapinnalle: uusi malli vaatii tuhannen vaihtoehdon poimintaa jokaisella sanalla, ja vanha lajittelutapa ei siihen taipunut. Lisäksi: Windowsin kehitysversiosta löytyi asetus, joka murtaa puolikkaan muistin rajan, agenttiohjelmisto OpenClaw ajaa nyt omaa llama.cpp-palvelintaan, NVIDIA ja MediaTek jatkavat pöytäkoneen kokoisen tekoälykoneen kehitystä — ja illan mini-PC-parissa kaksi noin 900 euron toimistokonetta jää molemmat kauas lehden 570 euron valinnasta.
Nro 57Sunnuntai 30. elokuuta 2026Viikonlopun kysymys oli, kuinka paljon pakatusta mallista jää jäljelle. Itävaltalainen tutkimuslaitos julkaisi Qwen 3.8:n 27 miljardin parametrin mallista pakatut versiot, joissa jokaiselle painomatriisille on haettu oma tarkkuutensa erikseen — 8,4 gigatavun tiedosto ratkaisee matematiikkakokeesta kymmenen prosenttiyksikköä enemmän kuin saman kokoinen tiedosto alan vakiintuneelta pakkaajalta. Samaan aikaan yhdysvaltalaisfoorumilla tehty mittaus kertoo, ettei pakkaus edes ole ainoa syy siihen, miksi kotona ajettu malli vastaa eri tavalla kuin virallinen: pelkkä huomiokerroksen laskentatavan vaihto riitti muuttamaan mallin valitsemia sanoja keskellä pitkää keskustelua. Kevyemmässä päässä ilta oli levyn ilta: llama.cpp oppi jättämään mallin suurimman taulukon kovalevylle, ja koboldcpp lataa mallitiedoston käyttöjärjestelmän välimuistin ohi. Lisäksi: AMD hyppäsi kahden versionumeron yli, Intelin 32 gigatavun työasemakortti ajaa 27 miljardin mallia 52 tokenin sekuntivauhtia, Apple nosti pienimmän pöytäkoneensa hintaa puolella — ja illan mini-PC-parissa toinen kone on täysin äänetön ja toinen lukee muistiaan lähes kolme kertaa nopeammin.
Nro 56Perjantai 28. elokuuta 2026Perjantai-illan iso uutinen tuli Pekingistä: Z.ai avasi GLM-5.3:n painot, ja kyseessä on 753 miljardin parametrin malli, joka on koodaustesteissä avoimen painon kärjessä. Kotikoneella sitä ei aja kukaan — pienin pakattu versio vie 217 gigatavua — mutta samana päivänä Tencent julkaisi 770 miljardin parametrin Hy4:n Apache 2.0 -lisenssillä, ja kahden mallin arkkitehtuurit ovat hämmentävän samannäköiset. Kevyemmässä päässä ilta oli luonnostelun ilta: LM Studio oppi kolme eri tapaa antaa pienen mallin kirjoittaa ison puolesta, ja yksi kehittäjä julkaisi GLM-5.3-Flashille oman 1,2 miljardin parametrin luonnostelupään. Lisäksi: llama.cpp ajaa nyt Qwen 3.5:tä Intelin NPU:lla, Applen M5:lle tuli omat viritykset, venäjänkielisessä suoratoistopuhesyntetisaattorissa on alle puoli miljardia parametria — ja illan mini-PC-parissa on käytännössä sama siru kahdesti, mutta vain toisessa koneessa on kaksi muistikampaa.
Nro 55Torstai 27. elokuuta 2026Torstain uutinen ei ollut malli vaan osoite. The Information kertoi aamulla, että Nvidia on sopinut ostavansa Hugging Facen 12,9 miljardilla dollarilla — eli sen paikan, josta jokainen tässä lehdessä käsitelty avoimen painon malli on ladattu. Allekirjoitusta ei ole, ja kumpikaan osapuoli ei kommentoi. Muualla ilta oli tekninen: neljän Mac Studion klusteri ylsi 4,8 teratavun sekuntikaistaan Thunderboltin yli ajetulla suoralla muistisiirrolla, vLLM siirsi välimuistinsa kolmannelle tasolle kovalevylle asti, ja llama.cpp sai valitsimen, jolla tiheänkin mallin syötekerroksia voi jättää suorittimelle. Lisäksi: Zhipun uusi malli paljastui ajetuksi kokonaan kiinalaisilla kiihdyttimillä, kolmen miljardin parametrin malli voitti puhelinvertailun, Ant Groupin tutkimusyksikkö avasi käyttöliittymäagentin painot — ja OpenAI o3 katosi eilen ChatGPT:stä.
Nro 54Keskiviikko 26. elokuuta 2026Keskiviikko oli avoimien painojen päivä, ja poikkeuksellisesti kaksi kertaa. Alibaba avasi Qwen3.8-Flash-Nextin — 125 miljardin parametrin asiantuntijamallin, jonka rinnalla kulkee 51 miljardin parametrin hakutaulukko, joka on suunniteltu pidettäväksi keskusmuistissa eikä näytönohjaimella. Muutamaa tuntia myöhemmin Zhipu julkaisi GLM-5.3-Flashin MIT-lisenssillä: 320 miljardia parametria, joista 18 aktiivisena, ja ensimmäistä kertaa GLM-sarjassa natiivisti monimuotoinen. Ohjelmistopuoli reagoi saman vuorokauden sisällä: Hugging Facen transformers julkaisi kaksi versiota kolmentoista minuutin välein, Ollama sai Qwenin uuden arkkitehtuurin MLX-taustalle, ja KTransformers lisäsi GLM:lle oman ajopolkunsa. Lisäksi: yksi kehittäjä siirsi Qwenin 51 miljardin taulukon SSD-levylle, Perplexity julkaisi agentistaan version joka ei ota yhteyttä mihinkään, Nvidia esitteli 78 TOPSin reunatietokoneen — ja mini-PC-palstalla 32 gigatavua hidasta muistia kohtaa 16 gigatavua nopeaa.
Nro 53Tiistai 25. elokuuta 2026Tiistaina paikallisen ajamisen katto nousi kahdesti. Apple esitteli aamupäivällä M5 Ultran, jonka pöytäkoneeseen mahtuu 512 gigatavua yhtenäistä muistia ja 1,2 teratavua sekunnissa kaistaa — ja mainitsi tiedotteessaan nimeltä LM Studion, ei omaa pilveään. Illalla Xiaomi näytti insinööriprototyypin, jonka oma piiri lukee muistia 1,22 teratavun sekuntivauhtia ja lupaa ajaa 200 miljardin parametrin mallia kotilaatikossa. Ohjelmistopuolella llama.cpp julkaisi version 0.3.0 ja opetti moniajon jakamaan tensorit eri kiihdyttimille, exllamav3 alkoi siirtää asiantuntijakerroksia keskusmuistiin lennossa, ja Tencent avasi kolme monimuotoista upotusmallia. Lisäksi: Windows sai piilotetun säätimen, jolla yhtenäisestä muistista voi varata palan mallille, videomalli jonka aiemmat versiot olivat avoimia hinnoiteltiin sekuntitaksalla, ja kaksi lähes identtistä mini-PC:tä joita erottaa vain yksi luku — jota kukaan ei mittaa samalla tavalla.
Nro 52Maanantai 24. elokuuta 2026Maanantai oli raudan päivä. NVIDIAn pöytäkonekokoinen DGX Station tuli vihdoin hintalapun kanssa myyntiin, ja sen 748 gigatavua yhtenäistä muistia maksaa saman verran kuin kaksi keskikokoista autoa. Samaan aikaan Japanissa pienempi sisarlaatikko DGX Spark ylitti miljoonan jenin rajan ja kiipesi maan suosituimmaksi pöytäkoneeksi — kysyntä paikalliseen ajamiseen ei ole hidastumassa. Ohjelmistopuolella Ollama vakautti 0.33-sarjansa ja korjasi välimuistivian, joka pakotti pitkiä keskusteluja alkamaan alusta, ja llama.cpp vaihtoi Mamba-mallien projektiot matriisikertolaskuun. Lisäksi: malli, joka julkaisee oman reputtaneen laatutestinsä, puheentunnistin joka vetäytyi tulostaululta omasta aloitteestaan, ja kaksi alle 600 euron mini-PC:tä, joiden muistiväylistä toinen on puolet kapeampi kuin tuotesivu antaa ymmärtää.
Nro 51Sunnuntai 23. elokuuta 2026Sunnuntain kiinnostavin uutinen ei ole uusi malli vaan uusi tapa laskea. Pieni yhtiö nimeltä Kairic julkaisi Qwen3.8-27B:stä version, joka ajaa AMD:n Strix Halo -piirillä nelibittisiä painoja ja nelibittisiä aktivaatioita suoraan piirin omalla matriisikäskyllä — ilman välivaihetta, jossa luvut levitetään takaisin leveämpään muotoon. Tulos on 47,73 tokenia sekunnissa siellä, missä sama malli tavallisessa nelibittipaketissa tuottaa 25,80. Neljä bittiä on siis lakannut olemasta pelkkä pakkaustapa ja alkanut olla laskutapa. Muualla ilta oli tekemisen iltaa. SGLang julkaisi version, jossa on 710 muutosta 212 kehittäjältä ja jonka näkyvin parannus on se, että palvelin lähtee käyntiin yli kaksi kertaa nopeammin. llama.cpp otti GLM-4.5-Airin oman luonnostelupään käyttöön ja alkoi pienentää kuvat samalla kaavalla kuin mallien alkuperäinen Python-toteutus. Yksi kehittäjä veisti Qwen3.8-27B:stä jälkikäteen asiantuntijaverkon ja sai sen toistamaan itseään enää 8 prosentissa vastauksista, kun ensimmäisessä versiossa luku oli 69. Rautapuolella tuli lasku. Nvidia kertoi nostavansa tekoälypalvelinten hintoja yli 15 prosenttia, ja sama muistipula näkyy jo kuluttajakaupassa: 16 gigatavun RTX 5060 Ti on kallistunut 39 prosenttia. Illan mini-PC-vertailussa se näkyy konkreettisesti — toinen vertailtavista koneista on olemassa juuri siksi, että valmistaja karsi siitä muistia ja tekoälypiirin saadakseen hinnan pysymään paikallaan.
Nro 50Lauantai 22. elokuuta 2026Lauantai toi harvinaisen selkeän pääuutisen: Ollama julkaisi aamuyöllä version 0.33, jonka myötä paikallisen mallin voi kytkeä työpöytäsovelluksiin suoraan valikosta — ja ensimmäisenä kytkettävien listalla on Anthropicin Claude. Samalla viikolla OpenAI vei ChatGPT:n Macin Viestit-sovellukseen, joten suunta on molemmilla sama ja kysymys yhteinen: kuka istuu sovellustesi ja tekstiesi välissä. Paikallisessa kytkennässä vastaus on tylsin mahdollinen, ja juuri siksi se kiinnostaa. Kiinalainen RedNote teki viikonlopusta omansa kahdella avauksella: eilen llama.cpp sai tuen sen teksti-, kuva- ja äänimalli dots3-notelle, ja tänään saman talon FireRed-tiimi avasi 9 miljardin parametrin äänimallin, joka kuuntelee, puhuu ja editoi puhetta yhdellä verkolla. Google puolestaan kertoi Gemma-perheen ylittäneen miljardin latauksen — ja kiinnostavin luku ei ole miljardi vaan satatuhatta yhteisön julkaisemaa varianttia. Mittarijutussa 18 kärkimallia pantiin tekemään tutkimusta ilman ihmistä, ja avoin Kimi K3 ylsi 10 askeleen päähän suljetusta kärjestä. Nvidia osti Poolsidesta kaiken paitsi yhtiön, mikä jättää kesän kehutuimman avoimen koodimallin jatkon auki. Illan vertailussa GEEKOMin 699 euron Intel kohtaa saman talon 447 euron AMD:n — ja lukija saa vastauksen siihen, mitä 252 euron välierolla oikeasti saa.
Nro 49Perjantai 21. elokuuta 2026Kolme päivää sen jälkeen, kun llama.cpp sai ensimmäistä kertaa oikeat versionumerot, se julkaisi tänään jo version 0.2.0 — ja sen muutoslista on samalla tiivistelmä siitä, missä paikallinen ajo juuri nyt kehittyy: ARM-koneiden matriisiytimissä, CUDA-virityksessä ja spekulatiivisen dekoodauksen tuessa. Ollama vastasi omalla tavallaan ja puolitti odotuksen ensimmäiseen sanaan. Turvallisuusrintamalla ilta on vakavampi. Yhdysvaltain kyberturvavirasto antoi liittovaltion virastoille kolme päivää aikaa paikata Ray-kehyksen aukko, jolla pelkkä selaimessa avattu sivu voi kaapata GPU-koneen louhintaverkkoon — takaraja umpeutui eilen, eikä aukko kysy, onko klusterisi virasto vai olohuone. OpenAI puolestaan kertoi hidastaneensa omaa kehitystään, koska sen tuleva Astra-malli saattaa ylittää kriittisen kyberkyvyn rajan: valvonta syö nyt viidenneksen päättelylaskennasta. Kevyemmässä päässä Tanska esitteli miljardin parametrin mallin, joka koulutettiin kahdeksalla näytönohjaimella ja voittaa tanskaksi kahdeksan miljardin koneet, ja 170 miljoonan parametrin puhesyntetisaattori lupaa äänikloonauksen läppärille. Illan vertailussa saman talon halvin ja järein: 575 ja 696,99 euroa, kaksi suoritinsukupolvea — ja täsmälleen sama pullonkaula.
Nro 48Torstai 20. elokuuta 2026Paikallisen tekoälyn myyntipuhe on aina ollut, että mikään ei lähde koneelta minnekään. Tänään sen tärkein monimoottoripalvelin muistutti, että lauseessa on aukko: LocalAI 4.9.0 sulki oletuksena jokaisen HTTP-reitin, koska vanha suojaus päästi osan reiteistä ohi kirjautumisen. Sama 146 korjauksen julkaisu toi keskusteluihin kontekstin pakkauksen, MiniMax-H3-videon ääniraitoineen ja Qwen3-TTS-puheen llama.cpp:n koko kiihdytinvalikoimalle. Muuten ilta kuului nopeuttajille. Liquid AI paketoi spekulatiivisen dekoodauksen luonnostelijansa erillisiksi GGUF-sivuvaunuiksi, Intel julkaisi yön aikana viralliset kvantisoinnit kesän ladatuimmasta mallista — pienin niistä lukee painonsa keskimäärin 2,8 bitillä — ja LocalAI:n tekijä pakkasi eilisen Ornith-julkaisun niin, että malli luonnostelee itse itseään. Unsloth Desktop oppi jatkamaan keskustelua kontekstin loputtua, ja whisper.cpp sai versionumeron viikko isoveljensä jälkeen. Illan vertailussa kaksi 700 euron konetta, joiden hintaero on tasan 2,01 euroa — ja yhteinen kompastuskivi, joka löytyy vasta kannen alta: kummassakin muistiväylästä on käytössä puolet. Suljetulla puolella Anthropic kertoi mallinsa suunnittelevan toimivia proteiineja, mutta piti juuri sen kyvyn lukkojen takana.
Nro 47Keskiviikko 19. elokuuta 2026Kolme ja puoli vuotta ja yli 10 500 numeroitua yökäännöstä — ja tänään llama.cpp:llä on versionumero. Paikallisen tekoälyn tärkein yksittäinen ohjelmisto julkaisi kahden päivän sisään versiot v0.1.0, v0.1.1 ja v0.1.2, sai virallisen asennussivun llama.app ja alkoi tänään allekirjoittaa julkaisupakettinsa. Muutos kuulostaa kirjanpidolta, mutta se on infrastruktuuria: vasta versionumeron myötä Debianin ja Homebrew'n kaltaiset jakelijat voivat luvata, että koneellesi asentuva libllama on yhteensopiva kaiken sen kanssa, mikä siihen nojaa. Mallipuolella ilta kuuluu pienille ja ahkerille: Ornith-koodariperhe päivittyi versioon 1.5 ja sen 35 miljardin MoE-malli lukee kerrallaan vain 3 miljardia, Japani julkaisi 33 miljardin parametrin avoimen kansallismallinsa, ja Qwen3.8-27B sai lohkodiffuusioon perustuvan luonnostelijan, joka lupaa moninkertaistaa paikallisen generoinnin. Rajapintapuolella GLM-5.3 tuli kaikkien käytettäväksi — painot ovat yhä lupaus, jonka määräpäivä lähestyy. Illan vertailussa kaksi konetta, joissa on täsmälleen sama piiri ja sama 64 gigatavua muistia — ja 1 069 euron hintaero, jonka perustelu ei ole nopeus. Samassa hintaluokassa myyntiin ehtineiden GB10-tekoälylaatikoiden EU-hinnat ovat karanneet jo 5 600 euroon, eikä yhdenkään lepomelusta ole julkaistu ainuttakaan mittausta.
Nro 46Tiistai 18. elokuuta 2026Yksi laatikko, kaksi mallia, kahdeksankertainen ero. Japanilainen PC Watch ajoi tänä aamuna Qwen3.8-27B:n NVIDIAn DGX Sparkilla ja sai 12,0 tokenia sekunnissa. Samalla koneella pyörii julkaisijan omissa mittauksissa toinen tämän illan malli, Ling-3.0-tiny, sadan tokenin vauhtia. Kummassakaan ei ole kyse laskentatehosta vaan siitä, montako gigatavua painoja koneen on luettava jokaista sanaa varten. Ling-3.0-tiny sai tänä yönä ensimmäiset kunnolliset GGUF-käännöksensä, eli 7,9 miljardin parametrin päättelymalli, joka aktivoi kerrallaan 1,4 miljardia, ajetaan nyt llama.cpp:llä viiden gigatavun tiedostosta. LM Studion agenttisovellus sai eilen taitojen asennuskomennot, ja japanilaisessa korjaamossa juotetaan RTX 2080 Ti:hin kaksinkertainen näytönmuisti 282 dollarilla. Suljetulla puolella yksi kokonainen mallisukupolvi katosi eilen rajapinnasta: Googlen Imagen 4 -päätepisteet suljettiin, ja kutsut ohjataan Geminin omaan kuvamalliin. Illan mini-PC-vertailussa kaksi toistatuhatta euroa maksavaa konetta ostaa muistia sillä rahalla, jolla halvempi kone ostaa kaistaa.
Nro 45Maanantai 17. elokuuta 2026Hugging Face laski kesän luvut, ja tulos on paikallisajajalle imarteleva: mallikerros kasvoi seitsemässä kuukaudessa 21 prosenttia, mutta kerros, joka päättää millä raudalla malli oikeasti pyörii, kasvoi 464. Alle miljardin parametrin mallit vievät yhä 83 prosenttia kaikista latauksista, ja biljoonan parametrin mallit tavoittavat tavallisen ihmisen vain yhtä reittiä — llama.cpp:n kautta. Sen omista muunnoksista mallitalot julkaisevat murto-osan. llama.cpp itse vietti viikonlopun palvelimen rinnakkaisuuden kimpussa: luonnostelu siirtyi omiin työsäikeisiinsä, ja ajattelubudjetti kulkee vihdoin läpi keskustelupohjan. Applen puolella kaksi keskeistä MLX-pakettia ilmestyi tänä iltana viiden minuutin välein. Suljetun puolen uutinen tuntuu suoraan lompakossa: DeepSeekin korotetut API-hinnat astuivat voimaan eilen, ja kalleimmillaan tuhannen tokenin ulostulo maksaa nyt yli neljä kertaa entisen. Saman yhtiön painot ovat edelleen MIT-lisenssillä ilmaisia. Illan mini-PC-vertailussa mitataan, mitä alle tuhannella eurolla saa, kun toinen kone on täysin äänetön ja toisessa on kaksi kertaa enemmän muistia.
Nro 44Sunnuntai 16. elokuuta 2026Torstaina julkaistun Qwen3.8-27B:n ympärille valmistui viikonlopun aikana kokonainen paikallisajon ketju, ja se on illan lehden runko. AMD julkaisi mallille päivä nollan tuen ja omat mittauksensa — testikoneena muuten tästä lehdestä tuttu mini-PC. Ollama nosti mallin viralliseen kirjastoonsa ja kytki sen yhdellä komennolla Claude Codeen ja kolmeen muuhun koodiagenttiin. Japanilaismedia ehti jo ajaa mallia käytännössä ja purkaa sen kovimmat väitteet osiin. Mittatikun päässä liikahti kahdesti: OpenAI tekee GPT-5.6 Lunasta ilmaiskäyttäjien oletuksen ja poistaa tekstikeskustelujen määrärajan — ja alkoi samalla viikolla kokeilla mainoksia ChatGPT:ssä. Ilmainen pilvi on nyt rajaton, mutta sillä on hintalappu, joka ei näy euroissa. Rautapuolella muistikriisi saavutti Strix Halon: 128 gigatavun yhteismuistikoneet karkasivat parissa viikossa yli kolmen tuhannen euron. Mini-PC-vertailussa kohtaavat pelikone, jonka hinta putosi rajusti, ja tekoälytyöasema, jonka valtti on muisti.
Nro 43Lauantai 15. elokuuta 2026Eilen tuli malli. Tänään tuli se, mikä mallin ympärille rakennetaan. DeepSeek avasi MIT-lisenssillä agenttirungon, jota se on itse käyttänyt omien malliensa mittaamiseen — ja jonka jokainen osa, myös malliyhteys, on vaihdettava liitännäinen. Se tarkoittaa käytännössä yhtä asiaa: sama runko, jolla ajetaan pilvimallia, ajaa myös sitä llama-serveriä, joka pyörii olohuoneessa. Illan toinen löydös tuli hiljaa PyPI:stä. Eilen aamuyöllä ilmestyi paketti nimeltä flm-add, ja sen mukana ensimmäinen julkinen mittaussarja siitä, mitä AMD:n NPU tekee neljän miljardin parametrin mallilla — ei valmistajan TOPS-lukuja vaan tokeneita sekunnissa, kuudessa kontekstipituudessa, keskihajonnat mukaan lukien. Luvut eivät ole imartelevia, ja juuri siksi ne ovat arvokkaita. Ja sitten on se, mistä tämä lehti kirjoittaa mielellään: Coherelle jäi mallikorttiin ohje asentaa transformers suoraan Gitistä, koska se versio, jota malli vaatii, ei ole vielä olemassa. Kolmen kappaleen juttu siitä, mitä tapahtuu kun mallit julkaistaan nopeammin kuin kirjastot. Rehellisyyden nimissä: tämä on kymmenen jutun numero, ja se on kymmenen jutun numero siksi, että aineistoa oli tasan siihen. Neljäntoista kielen hakukierros oli tänään laihin pitkään aikaan — saksa, ruotsi, norja, tanska, ranska, viro, latvia, liettua, hindi ja turkki eivät tuottaneet ainuttakaan tuoretta löydöstä. Japani pelasti illan.
Nro 42Perjantai 14. elokuuta 2026Se tuli, ja se tuli päivää etuajassa. Qwen3.8-27B on Hugging Facessa Apache 2.0 -lisenssillä: kahdenkymmenenseitsemän miljardin parametrin tiheä malli, joka näkee kuvat ja videot, jonka konteksti on kaksisataakuusikymmentäkaksituhatta tokenia ja venyy miljoonaan, ja jonka kerroksista kolme neljäsosaa ei laske klassista huomiota lainkaan. Tämä lehti on odottanut sitä kolme päivää — ja odottanut siksi, että se on tämän vuoden ensimmäinen huippumalli, joka mahtuu neljän bitin luokassa yhdelle kahdenkymmenenneljän gigatavun näytönohjaimelle. Julkaisuhetken kertoi ensimmäisenä japanilainen PC Watch: painot ilmestyivät Japanin aikaa viisitoista minuuttia yli puolenyön, eli Euroopassa perjantai-iltana. Sama lehti kertoi myös illan toisen mallikuulumisen: Z.ai julkisti GLM-5.3:n, joka on yhtiön oman mittauksen mukaan vahvin avoimen painon koodimalli — ja jonka painoja ei saa vielä kahteen viikkoon, koska yhtiö haluaa ensin tarkistaa, mitä sen kyberosaamiselle tapahtui koulutuksen aikana. Pienemmässä päässä Liquid AI julkaisi keskiviikkona LFM2.5-VL-3B:n, joka mahtuu kolmeen gigatavuun ja lukee tietokoneen näyttöä paremmin kuin moni kolme kertaa suurempi malli. Ja mini-PC-palstalla vuorossa on alle tuhannen euron luokka, jossa vertailtavana on kaksi konetta, joiden lepomelu on mitattu täsmälleen samaan lukemaan — ja joiden hinta-laatuindeksi eroaa silti neljänneksellä. Rehellisyyden nimissä kaksi asiaa. Tästä numerosta puuttuu Media-palsta: kahden vuorokauden haku ei tuottanut yhtään varmistettua uutta avoimen painon kuva-, video- tai puhemallia, eikä täytettä tässä kirjoiteta. Ja monikielinen hakukierros oli tänään laiha — neljästätoista kielestä vain japani ja kiina toivat numeroon asti yltäneitä löydöksiä.
Nro 41Torstai 13. elokuuta 2026DeepSeek julkaisi tänään lippulaivansa avoimin painoin. DeepSeek-V4-Pro-0813 on MIT-lisenssillä jaettava sekoitusmalli, jonka FP8-painot vievät 892,8 gigatavua ja jonka sisään on koulutettu oma spekulatiivisen dekoodauksen moduuli nimeltä DSpark. Kotikoneelle se ei mahdu missään muodossa — mutta tämä ilta jää silti mieleen siitä, kuinka valmiina paikallinen työkaluketju jättiläistä odotti. Sillä juuri tänään llama.cpp yhdisti kolme spekulatiivisen dekoodauksen muutosta, joiden jälkeen luonnosmallin tyyppiä ei enää kerrota käsin — se luetaan GGUF-tiedoston metatiedoista, ja näytönohjaimella tapahtuva näytteenotto toimii myös DSpark- ja DFlash-luonnoksilla. vLLM ehti jo aiemmin samalle viikolle kahdella DSpark-julkaisulla, ja Unsloth julkisti työpöytäsovelluksensa virallisesti. Harvoin uusi mallijulkaisu on laskeutunut näin katettuun pöytään. Riippumaton mittaus ehti sekin samaan vuorokauteen: Artificial Analysis antaa uudelle Prolle pistemäärän 53 — täsmälleen yhden pisteen enemmän kuin talon omalle, monin verroin halvemmalle Flash-mallille. Japanilainen PC Watch puolestaan vahvistaa, että rajapinnan hinnat eivät julkaisussa muuttuneet. Raudan puolella uutiset ovat tylympiä: Nvidia korotti 96 gigatavun RTX Pro 6000:n hinnan 16 000 dollariin, ja korotuksia kertyy julkaisusta jo 88 prosenttia. Mini-PC-palstalla sen sijaan tapahtui jotain, mitä on odotettu kolme viikkoa: kalleimmasta hintaluokasta löytyi vihdoin mitattua melutietoa, ja vertailuun saatiin HP:n 64 gigatavun työasema ja ASUSin näytönohjainkone. Ja Linux-työpöydälle, paikallisen tekoälyn kotikentälle, saapui yllättävä vieras: ChatGPT.
Nro 40Keskiviikko 12. elokuuta 2026Alibaba teki tänään sen, mitä se on luvannut kaksi viikkoa: Qwen-perheen ylin Max-luokan malli tuli ulos avoimin painoin. Kaksi biljoonaa neljäsataa miljardia parametria, joista yhdeksänkymmentäviisi miljardia laskee. Se on ylivoimaisesti suurin koskaan avoimena julkaistu kielimalli — ja samalla ensimmäinen, jonka kohdalla tämän lehden pitää sanoa lukijalle rehellisesti: tätä et aja kotona. Unslothin yhden bitin kvantisointi painaa viisisataakahdeksan gigatavua. Se ei ole kirjoitusvirhe. Siksi illan toiseksi tärkein uutinen on pienempi ja tärkeämpi. Saman perheen kaksikymmentäseitsemän miljardin tiheä malli on lähtölaskennassa ModelScopessa, ja japanilainen PC Watch ilmoittaa päivämääräksi lauantain. Se on se, joka mahtuu yhteen näytönohjaimeen — ja se on se, jota tämän lehden lukijat oikeasti ajavat. llama.cpp reagoi jättimalliin samana aamuna tavalla, joka ei näy otsikossa lainkaan: kvantisoinnin tärkeysmatriisi lakkasi käymästä läpi asiantuntijoita, joihin ei koskettu. Se on yhden rivin muutos, joka ratkaisee sen, onko biljoonaluokan sekoitusmallin kvantisointi tuntien vai vuorokausien työ. Monikielinen hakuvaihe tuotti tänään kaksi numeroon asti päätynyttä löydöstä, ja molemmat ovat sellaisia, joita englanninkielinen haku ei antanut. Japanilainen PC Watch uutisoi Qwenin avoimista painoista ennen kuin ne näkyivät läntisessä mediassa. Ja Norjan kansalliskirjasto julkisti maanantaina kielimalliperheen, jonka koulutusaineistossa on tekijänoikeussuojattua sanomalehtitekstiä — laillisesti, kollektiivisopimuksella, neljänkymmenenviiden miljoonan kruunun vuosikorvausta vastaan. Se on eurooppalaisin uutinen, jonka tämä lehti on pitkään aikaan kirjoittanut. Mini-PC-palstalla vuorossa oli tuhannen ja kahdentuhannen euron luokka. Toista iltaa peräkkäin luokka ei tuottanut kahta konetta, jotka täyttäisivät kaikki neljä valintakriteeriä — ja tänään illan Laitteisto-juttu kertoo, miksi. Muistin hinta nousee niin nopeasti, että näytönohjaimissa se näkyy neljänkymmenen prosentin hyppyinä ja minikoneissa siinä, että valmiit kokoonpanot katosivat hyllyltä ennakkomyyntiin.
Nro 39Tiistai 11. elokuuta 2026Eilen illalla Meta julkaisi Muse Glimmerin ja koko ala kirjoitti siitä. Tänään Nvidia julkaisi mallin, joka on rakennettu tekemään sitä työtä, jota agentti oikeasti tekee: kolmenkymmenen miljardin sekoitusmalli, josta laskee kolme miljardia, ja jonka koko olemassaolon perustelu on se, ettei jokaista työkalukutsua kannata ajaa rajamallilla. Nemotron 3.5 Lightning on illan pääjuttu, ja sen mukana tuli poikkeuksellisen paljon konkreettista: kaksi luonnostelijamallia, NVFP4-tarkistuspiste, koulutusdata, reseptit — ja OpenMDW-lisenssi, joka ei rajoita kaupallista käyttöä. llama.cpp teki vuorokaudessa kaksi asiaa, jotka kannattaa lukea vaikkei niiden otsikoissa lue mitään. Toinen siirsi näytteenoton laskentataustaan ja liitti sen samaan syliin spekulatiivisen dekoodauksen kanssa. Toinen vaihtoi koko ROCm-käännösketjun uuteen rakennusjärjestelmään, mikä koskee jokaista, joka ajaa AMD:llä. Monikielinen hakuvaihe tuotti tänään vähemmän kuin eilen, ja se on rehellistä sanoa suoraan: saksa, tanska, viro, latvia, liettua, hindi ja ranska eivät antaneet mitään tuoretta, ja japani, kiina, kreikka, espanja ja turkki toistivat eilisen Muse Glimmer -uutisen omilla kielillään. Yksi löydös nousi silti numeroon asti, ja se tuli ruotsalaiselta keskustelupalstalta: vinkki laskentakortista, jolla saa kaksisataakaksikymmentä gigatavua sekunnissa muistikaistaa alle viidelläsadalla eurolla. Mini-PC-palstalla vuorossa oli alle tuhannen euron luokka. Se luokka ei tänä iltana tuottanut yhtään konetta, joka täyttäisi kaikki neljä valintakriteeriä — muistin hinta on nostanut jokaisen kelvollisen laitteen tuhannen euron yli. Vertailu tehtiin siksi hieman luokan yläpuolelta, ja se sattuu olemaan tämän lehden indeksin kannalta opettavaisin pari pitkään aikaan: kaksi konetta, joissa on sama piiri, sama muisti ja sama kaista, ja joiden ainoa mitattava ero on tuulettimen ääni.
Nro 38Maanantai 10. elokuuta 2026Tämä on päivän toinen numero, ja syy on yksi: Meta julkaisi tänään Muse Glimmerin, kolmenkymmenen miljardin parametrin monimodaalisen agenttimallin, jonka painot ovat Apache 2.0 -lisenssillä Hugging Facessa. Aamun numerossa kirjoitimme, että viikon odotetuin asia ei ehtinyt mukaan. Se ei ollut tämä. Alibaban Qwen3.8-Maxin painot ovat yhä julkaisematta — mutta Meta ehti väliin mallilla, joka on rakennettu nimenomaan sinun koneellasi ajettavaksi, ja koko työkaluketju tuki sitä julkaisupäivänä. Numero on rakennettu kaksivaiheisesta hausta, ja tänään monikielinen vaihe teki työn: Muse Glimmer nousi ensin kreikkalaisesta ja espanjalaisesta lähteestä, ja vasta sen jälkeen se varmistui Metan omalta tutkimusblogilta ja mallikortilta. Samaa reittiä tulivat myös turkkilainen oikeusmalli Mizan-27B ja Liettuan valtiollinen kielimallihanke, joista kummastakaan ei ole englanninkielistä uutisointia. Mini-PC-palstalla on tänään poikkeus, joka on kerrottava heti: vuorossa ollut 2 000–3 000 euron luokka ei tuottanut yhtään konetta, joka täyttäisi kaikki neljä valintakriteeriä. Muistipula on työntänyt Strix Halo -koneet luokan yläpuolelle, ja luokkaan jääneiltä puuttuu mitattu lepomelu. Vertailu tehtiin siksi kahdella koneella, jotka täyttävät kriteerit mutta ovat luokan yläpuolella — ja niiden asetelma sattuu olemaan juuri se, jonka illan pääuutinen tekee ajankohtaiseksi: kuusitoista gigatavua nopeaa näytönohjainmuistia vastaan satakaksikymmentäkahdeksan gigatavua hitaampaa yhteismuistia.
Nro 37Maanantai 10. elokuuta 2026Viikonloppu oli uutisrintamalla hiljainen, mutta työkalupenkki lauloi. Unsloth kytki DSpark-spekulatiivisen dekoodauksen oletukseksi ja lupaa jopa kaksinkertaisen päättelynopeuden, ja sen työpöytäsovelluksen beta korjasi samalla reiän, jossa käynnistyspyyntöjä lähetettiin varmistamattomaan porttiin. llama.cpp siivosi AMD-buildinsa yhdestä lipusta ja korjasi RISC-V-taustaosastaan puuttuvan kvanttimuodon. vLLM julkaisi kaksi julkaisukandidaattia kolmessa päivässä — iso versionumero on ovella. Ja eilen sunnuntaina OpenAI:n Atlas-selain lakkasi toimimasta lopullisesti. Viikon odotetuin asia ei ehtinyt tähän numeroon: Alibaba lupasi Qwen3.8-Maxin ja 27B-mallin painot tälle viikolle, ja vielä maanantain vastaisena yönä kumpaakaan ei ollut Hugging Facessa eikä ModelScopessa — kiinalaiset mallikortit kirjaavat yhä, ettei painoja ole avattu. Kun ne tulevat, ne ovat seuraavan numeron pääuutinen. Mini-PC-palstalla on tänään harvinainen asetelma: saman valmistajan AMD- ja Intel-koneet vastakkain, ja ero kuuluu ennen kuin se näkyy.