Tekoälyn päivälehti — mallit, työkalut ja hardware
Maanantai · 17. elokuuta 2026Iltapainos · klo 21Nro 45
Hugging Face laski kesän luvut, ja tulos on paikallisajajalle imarteleva: mallikerros kasvoi seitsemässä kuukaudessa 21 prosenttia, mutta kerros, joka päättää millä raudalla malli oikeasti pyörii, kasvoi 464. Alle miljardin parametrin mallit vievät yhä 83 prosenttia kaikista latauksista, ja biljoonan parametrin mallit tavoittavat tavallisen ihmisen vain yhtä reittiä — llama.cpp:n kautta. Sen omista muunnoksista mallitalot julkaisevat murto-osan.
llama.cpp itse vietti viikonlopun palvelimen rinnakkaisuuden kimpussa: luonnostelu siirtyi omiin työsäikeisiinsä, ja ajattelubudjetti kulkee vihdoin läpi keskustelupohjan. Applen puolella kaksi keskeistä MLX-pakettia ilmestyi tänä iltana viiden minuutin välein.
Suljetun puolen uutinen tuntuu suoraan lompakossa: DeepSeekin korotetut API-hinnat astuivat voimaan eilen, ja kalleimmillaan tuhannen tokenin ulostulo maksaa nyt yli neljä kertaa entisen. Saman yhtiön painot ovat edelleen MIT-lisenssillä ilmaisia. Illan mini-PC-vertailussa mitataan, mitä alle tuhannella eurolla saa, kun toinen kone on täysin äänetön ja toisessa on kaksi kertaa enemmän muistia.
Alle miljardin parametrin mallit vievät 83 prosenttia kaikista latauksista, Qwenin GGUF-versioita noudetaan 39,6 miljoonaa kertaa kuukaudessa — ja niistä 28 531 muunnoksesta Qwen itse on julkaissut 54. Raportti mittasi ensimmäistä kertaa erikseen sen kerroksen, joka ratkaisee millä raudalla malli pyörii.
Neljä julkaisua neljänä päivänä. Painavin on palvelimen säiemallin uudelleensuunnittelu, joka siirtää spekulatiivisen dekoodauksen työsäikeisiin — se ratkaisee, mitä tapahtuu kun samalle mallille tulee monta pyyntöä yhtä aikaa.
Viisi julkaisua kahdessa päivässä. Mukaan tulivat DeepSeekin Harness ja Metan Muse Code, verkkohaku aukesi vakiorajapinnan kautta, ja llama-serverille lisättiin WebP-kuvien muunnos.
GMKtecin julkaisematon EVO-X5 ilmestyi Geekbench-tietokantaan AMD:n Ryzen AI Max+ PRO 495:llä eli Gorgon Halolla. Testikoneessa oli 128 gigatavua muistia ja Vulkan-tulos 103 729 — mutta paikallisajajalle ratkaiseva luku on muistikatto, ei pistemäärä.
V4-Pron ulostulotokenit maksavat ruuhka-aikaan 3,96 dollaria miljoonalta, kun hinta oli 0,87. Korotukset ovat 50 prosentista yli 1 100 prosenttiin. Saman yhtiön painot ovat edelleen MIT-lisenssillä ilmaisia — ja se muuttaa laskutoimituksen.
mlx-audio 0.5.0 ja mlx-vlm 0.6.14 ilmestyivät PyPI:hin tänä iltana kello 17.47 ja 17.52 UTC. Sarjan hyppy 0.4:stä 0.5:een on ensimmäinen sitten kevään, ja näköpaketti riippuu puhepaketista — siksi ne liikkuvat yhdessä.
Shunya Labsin Vak Conformer on Hugging Facessa avoimin painoin. Arkkitehtuuri on Conformer, kielivalikoima kuusi intialaista kieltä — mutta parametrimäärää, koulutusaineistoa eikä vertailulukuja ole julkaistu, ja lisenssi on räätälöity.
Kieltolistat toimivat huonosti pienillä malleilla, ja usein ne toimivat päinvastoin kuin on tarkoitus. Sama ohje myönteisenä käskylistana pitää mallin ruodussa selvästi paremmin — mutta se ei korjaa asiavirheitä.
LiteLLM kääntää yli sadan palveluntarjoajan rajapinnat OpenAI-muotoon, ja paikalliset taustat kuten Ollama ja vLLM ovat mukana samalla listalla. Illan hinnankorotusuutisen jälkeen se on kirjasto, jolla vaihto tehdään yhtä merkkijonoa muuttamalla.
Saman valmistajan kaksi konetta, 60 euroa hintaeroa ja täysin vastakkaiset kompromissit: toisessa ei ole tuuletinta lainkaan, toisessa on kaksinkertainen muisti ja mitattu 33,4 desibelin lepomelu. Kummankaan muisti ei liiku leveää väylää pitkin.
Kolme pakettia, jotka ilmestyivät tämän vuorokauden aikana
Illan kaikki kolme komentoa asentavat jotain, joka on julkaistu viimeisen vuorokauden sisällä. Ensimmäinen kiinnittää illan Koodi-palstan portin täsmälleen siihen versioon, josta juttu kertoo. Toinen noutaa llama.cpp:n Python-sidonnan, joka heräsi tänään yli kuukauden hiljaisuudesta. Kolmas on Mac-käyttäjille: Applen MLX-pinon puhe- ja näköpaketit julkaistiin tänä iltana viiden minuutin välein.
Versionumero kannattaa kiinnittää nimenomaan litellmissä: projektilla on PyPI:ssä yli 1 100 julkaisua, ja vakaan version rinnalla kulkee jo seuraavan sarjan julkaisuehdokas, joka asentuu vahingossa jos sallii esiversiot. llama-cpp-python 0.3.35 ilmestyi tänään aamupäivällä, ja se on ensimmäinen julkaisu 12. heinäkuuta jälkeen — paketti kääntää mukanaan oman llama.cpp-käännöksensä, joten asennus kestää ensimmäisellä kerralla minuutteja. Kolmas komento toimii vain Apple silicon -koneella; mlx-vlm vetää mukanaan mlx-audion joka tapauksessa, mutta molempien nimeäminen varmistaa, että myös puhepaketti päivittyy tuoreimpaan.