Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Maanantai · 17. elokuuta 2026Iltapainos · klo 21Nro 45
← Takaisin etusivulle

Hugging Face · kesäraportti · 14.8.2026 · Benchmarkit

Mallikerros kasvoi 21 prosenttia, GGUF-kerros 464 — Hugging Facen kesäraportti kertoo, missä paikallinen ajo oikeasti on

Alle miljardin parametrin mallit vievät 83 prosenttia kaikista latauksista, Qwenin GGUF-versioita noudetaan 39,6 miljoonaa kertaa kuukaudessa — ja niistä 28 531 muunnoksesta Qwen itse on julkaissut 54. Raportti mittasi ensimmäistä kertaa erikseen sen kerroksen, joka ratkaisee millä raudalla malli pyörii.

Kasvu tammi–heinäkuu 2026+16 %transformers+21 %mallirepot+148 %mlx+194 %lerobot+464 %gguf

Hugging Face julkaisi 14. elokuuta puolivuotisraporttinsa avointen mallien tilasta, ja se on harvinaisen suoraan tämän lehden aihepiiristä. Raportti kattaa tammi–heinäkuun 2026 ja perustuu palvelun omaan liikennedataan. Julkisia mallirepositorioita on nyt 2,96 miljoonaa, kun tammikuussa oli 2,43 miljoonaa; aineistoja on miljoona ja Space-sovelluksia 1,44 miljoonaa. Jakauma niiden alla on jyrkkä: 85,6 prosentilla malleista on koko elinkaarensa aikana alle 200 latausta, ja 1,5 prosenttia repositorioista kerää 99,2 prosenttia kaikista latauksista.

Paikallisajajan kannalta kiinnostavin luku on kuitenkin kasvuvertailu. Mallirepositorioiden määrä kasvoi seitsemässä kuukaudessa 21,5 prosenttia. Samaan aikaan kirjastotunnisteella gguf merkittyjen repositorioiden määrä kasvoi 464 prosenttia, lerobotin 194 ja Applen mlx:n 148 — kun transformers ja peft kasvoivat 16 ja diffusers 21 prosenttia. Mallinnuksen ydin kasvaa siis suunnilleen alustan keskivauhtia, mutta se kerros, joka päättää millä laitteella malli fyysisesti pystyy pyörimään, kasvaa kolmesta seitsemään kertaa nopeammin. Raportti sanoo tämän itse ääneen, ja se on merkittävä muotoilu talolta, joka on rakentanut maineensa mallipainojen jakelijana.

Toinen paikallisajon kannalta olennainen löydös on koon ja käytön suhde. Malleista, jotka ilmoittavat parametrimääränsä, alle miljardin parametrin mallit vievät 83 prosenttia kaikista koko historian latauksista, ja yli sadan miljardin mallit yhden prosentin. Kun tarkastelu rajataan pelkkään vuoteen 2026, kuva ei muutu: vain kolme prosenttia latausvolyymista menee yli 70 miljardin parametrin malleille. Syy on raportin mukaan yksinkertainen — pienet mallit ovat ainoita, jotka pyörivät sillä raudalla, joka kehittäjillä oikeasti on.

Miten biljoonan parametrin malli sitten tavoittaa ketään? llama.cpp:n kautta. Raportti muistuttaa, että ggml-tiimi liittyi Hugging Faceen helmikuussa, ja että heinäkuun tilannekuvassa Hubissa oli GGUF-käännökset noin 284 miljardin parametrin DeepSeek-V4-Flashista ja noin 2,8 biljoonan Kimi-K3:sta. Paikallinen ajo tarkoitti ennen kahdeksan miljardin mallia kannettavalla; nyt se voi tarkoittaa biljoonaluokan asiantuntijasekoitusta, joka on levitetty muutamalle kuluttajakoneelle. Japanilainen PC Watch nosti tänään omassa analyysissään esiin juuri tämän kohdan: llama.cpp osaa nykyään yhdistää useamman koneen muistin ja näytönohjaimet yhdeksi ajoalustaksi, ja se on ainoa syy, miksi kärkimallien julkaisu pelkästään suurina kokoina on ylipäätään järkevää.

Ja se reitti kulkee Qwenin kautta. GGUF-latauksia kertyy Qwen-malleille 39,6 miljoonaa kuukaudessa, Gemmalle 20,8 miljoonaa ja Llamalle 7,5 miljoonaa. Ero ei selity tarjonnalla: Llama-pohjaisia GGUF-repositorioita on Hubissa hivenen enemmän kuin Qwen-pohjaisia. Sama hyllytila, viidesosa liikenteestä. Laajemmin Qwen-pohjaisia johdannaisia on 151 448 kappaletta — 2,6-kertaisesti Metan koko jalanjälki ja 4,7-kertaisesti pelkkien Llama-repositorioiden määrä — ja niitä syntyy 180–210 uutta joka päivä. Kolmanneksi suurin johdannaisten lähde on Unsloth, yhteisötili, joka julkaisee kvantisoituja ja hienosäätövalmiita versioita.

Raportin terävin huomautus on osoitettu mallitaloille. Qwen-mallien GGUF-muunnoksia on Hubissa 28 531 kappaletta, ja niistä Qwen itse on julkaissut 54. Kymmenen suurimman malliperheen joukossa virallisia GGUF-käännöksiä julkaistaan hyvin vähän — ja silti juuri GGUF on se muoto, jolla mallia paikallisesti ajetaan. Hugging Face esittää, että virallinen muunnos julkaisupäivänä, dokumentoidut kvantisointivalinnat ja allekirjoitetut tiedostot vaatisivat vähän lisätyötä, ja että vaihtoehtoisesti talot voisivat tehdä sen yhdessä Unslothin kaltaisten toimijoiden kanssa. Kysymys on siitä, että mallin tekijöiden testaamat painot ja yhteisön oikeasti ajamat versiot eivät ole samat tiedostot.

Lisenssipuoli sai raportissa jälkikäteen korjauksen, joka kannattaa lukea. Kiinalaisista yli 20 miljardin parametrin julkaisuista — niitä oli tänä vuonna 178 — 59 prosenttia on Apache 2.0:lla ja 22 prosenttia MIT:llä, kun amerikkalaisella puolella samassa kokoluokassa Apachea tai MIT:tä on 29 prosenttia, räätälöityjä ehtoja 41 ja tyhjä lisenssikenttä 30 prosentissa. Raportti kuitenkin lisää, että aivan viime viikkoina suunta on kääntynyt suurimmissa malleissa: Kimi K3 ja Qwen3.8 ovat alkaneet liittää lisensseihinsä ei-kaupallisia rajoituksia ja tulonjakovaatimuksia. Kotikäyttäjää se ei koske, mutta se on ensimmäinen merkki siitä, että avoimen painon lisenssi ei enää automaattisesti tarkoita samaa kuin puoli vuotta sitten.

Viimeinen luku on uusi laji kokonaan. Heinäkuussa julkaistu agent-usage-aineisto kertoo, mitkä koodiagentit kutsuvat Hubia. Heinäkuussa Claude Code vastasi 44,4 prosentista agenttiliikenteestä, mutta kuukausisarja paljastaa markkinan, jolla ei ole vakiintunutta johtajaa: huhtikuussa sama luku oli 67,8 ja toukokuussa 6,4 prosenttia, kun Codex kiipesi tasaisesti 10,4:stä 20,8 prosenttiin. Lähes neljännes heinäkuun agenttiliikenteestä tuli rungoista, joita aineisto ei vielä osaa nimetä — toukokuussa osuus oli 59,8 prosenttia. Uusia tulijoita ilmaantuu nopeammin kuin mikään rekisteri ehtii nimetä niitä, ja se on itsessään löydös.

Lisälähteet

Muut jutut tässä numerossa