Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Maanantai · 17. elokuuta 2026Iltapainos · klo 21Nro 45

Hugging Face laski kesän luvut, ja tulos on paikallisajajalle imarteleva: mallikerros kasvoi seitsemässä kuukaudessa 21 prosenttia, mutta kerros, joka päättää millä raudalla malli oikeasti pyörii, kasvoi 464. Alle miljardin parametrin mallit vievät yhä 83 prosenttia kaikista latauksista, ja biljoonan parametrin mallit tavoittavat tavallisen ihmisen vain yhtä reittiä — llama.cpp:n kautta. Sen omista muunnoksista mallitalot julkaisevat murto-osan. llama.cpp itse vietti viikonlopun palvelimen rinnakkaisuuden kimpussa: luonnostelu siirtyi omiin työsäikeisiinsä, ja ajattelubudjetti kulkee vihdoin läpi keskustelupohjan. Applen puolella kaksi keskeistä MLX-pakettia ilmestyi tänä iltana viiden minuutin välein. Suljetun puolen uutinen tuntuu suoraan lompakossa: DeepSeekin korotetut API-hinnat astuivat voimaan eilen, ja kalleimmillaan tuhannen tokenin ulostulo maksaa nyt yli neljä kertaa entisen. Saman yhtiön painot ovat edelleen MIT-lisenssillä ilmaisia. Illan mini-PC-vertailussa mitataan, mitä alle tuhannella eurolla saa, kun toinen kone on täysin äänetön ja toisessa on kaksi kertaa enemmän muistia.

Kasvu tammi–heinäkuu 2026+16 %transformers+21 %mallirepot+148 %mlx+194 %lerobot+464 %gguf

Hugging Face · kesäraportti · 14.8.2026

Mallikerros kasvoi 21 prosenttia, GGUF-kerros 464 — Hugging Facen kesäraportti kertoo, missä paikallinen ajo oikeasti on

Alle miljardin parametrin mallit vievät 83 prosenttia kaikista latauksista, Qwenin GGUF-versioita noudetaan 39,6 miljoonaa kertaa kuukaudessa — ja niistä 28 531 muunnoksesta Qwen itse on julkaissut 54. Raportti mittasi ensimmäistä kertaa erikseen sen kerroksen, joka ratkaisee millä raudalla malli pyörii.

Lue pääjuttu →

ennenb10447pääsäieluonnosteluluonnosteluluonnostelujono odottaapääsäietyösäikeetrinnakkainspekulatiivinen dekoodaus irtosi pääsäikeestä

llama.cpp · b10434–b10456 · 14.–17.8.2026

Palvelin oppi ajamaan luonnostelun omassa säikeessään — llama.cpp:n viikonloppu meni rinnakkaisuuden kimppuun

Neljä julkaisua neljänä päivänä. Painavin on palvelimen säiemallin uudelleensuunnittelu, joka siirtää spekulatiivisen dekoodauksen työsäikeisiin — se ratkaisee, mitä tapahtuu kun samalle mallille tulee monta pyyntöä yhtä aikaa.

Lue juttu →

Yhteismuistin katto kuluttajakoneessa64 GBStrix Halo128 GBEVO-X5 (vuoto)192 GBluvattu myöhemmin

GMKtec · Geekbench-vuoto · 15.–16.8.2026

Vuotanut mini-PC lupaa 128 gigatavua yhteismuistia — ja seuraavassa polvessa 192

GMKtecin julkaisematon EVO-X5 ilmestyi Geekbench-tietokantaan AMD:n Ryzen AI Max+ PRO 495:llä eli Gorgon Halolla. Testikoneessa oli 128 gigatavua muistia ja Vulkan-tulos 103 729 — mutta paikallisajajalle ratkaiseva luku on muistikatto, ei pistemäärä.

Lue juttu →

V4-Pro, ulostulo · dollaria miljoonalta tokenilta0,87ennen1,98ruuhka-ajan ulkopuolella3,96ruuhka-aikaan

DeepSeek · voimaan 16.8.2026 klo 16 UTC

Halvin kärkirajapinta ei ole enää halpa — DeepSeekin korotetut hinnat astuivat voimaan sunnuntaina

V4-Pron ulostulotokenit maksavat ruuhka-aikaan 3,96 dollaria miljoonalta, kun hinta oli 0,87. Korotukset ovat 50 prosentista yli 1 100 prosenttiin. Saman yhtiön painot ovat edelleen MIT-lisenssillä ilmaisia — ja se muuttaa laskutoimituksen.

Lue juttu →

kieltolistaälä aloita kohteliaisuudellaälä käytä englantiaälä lisää yhteenvetoaälä keksi mitään✕käskylistaaloita suoraan väitteelläkirjoita vain suomeksipäätä viimeiseen faktaanmerkitse puuttuva tieto✓

Päivän promptivinkki

Älä kiellä pientä mallia — käske sen sijaan, koska kielto jättää kielletyn sanan muistiin

Kieltolistat toimivat huonosti pienillä malleilla, ja usein ne toimivat päinvastoin kuin on tarkoitus. Sama ohje myönteisenä käskylistana pitää mallin ruodussa selvästi paremmin — mutta se ei korjaa asiavirheitä.

Lue juttu →

iX12A7 20268 GB16 GB0 tuuletintatäysin äänetön33,4 dB levossamitattu, igor'sLABvs

Illan mini-PC-vertailu · alle 1 000 €

GEEKOM iX12 vastaan GEEKOM A7 2026 — täysin äänetön pikkulaatikko kohtasi kaksi kertaa muistikkaamman

Saman valmistajan kaksi konetta, 60 euroa hintaeroa ja täysin vastakkaiset kompromissit: toisessa ei ole tuuletinta lainkaan, toisessa on kaksinkertainen muisti ja mitattu 33,4 desibelin lepomelu. Kummankaan muisti ei liiku leveää väylää pitkin.

Lue juttu →

Kokeilemisen arvoista

Kolme pakettia, jotka ilmestyivät tämän vuorokauden aikana

Illan kaikki kolme komentoa asentavat jotain, joka on julkaistu viimeisen vuorokauden sisällä. Ensimmäinen kiinnittää illan Koodi-palstan portin täsmälleen siihen versioon, josta juttu kertoo. Toinen noutaa llama.cpp:n Python-sidonnan, joka heräsi tänään yli kuukauden hiljaisuudesta. Kolmas on Mac-käyttäjille: Applen MLX-pinon puhe- ja näköpaketit julkaistiin tänä iltana viiden minuutin välein.

pip install litellm==1.97.0
pip install -U llama-cpp-python
pip install -U mlx-audio mlx-vlm

Versionumero kannattaa kiinnittää nimenomaan litellmissä: projektilla on PyPI:ssä yli 1 100 julkaisua, ja vakaan version rinnalla kulkee jo seuraavan sarjan julkaisuehdokas, joka asentuu vahingossa jos sallii esiversiot. llama-cpp-python 0.3.35 ilmestyi tänään aamupäivällä, ja se on ensimmäinen julkaisu 12. heinäkuuta jälkeen — paketti kääntää mukanaan oman llama.cpp-käännöksensä, joten asennus kestää ensimmäisellä kerralla minuutteja. Kolmas komento toimii vain Apple silicon -koneella; mlx-vlm vetää mukanaan mlx-audion joka tapauksessa, mutta molempien nimeäminen varmistaa, että myös puhepaketti päivittyy tuoreimpaan.