Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Maanantai · 10. elokuuta 2026Iltapainos · klo 21Nro 38
← Takaisin etusivulle

Meta Superintelligence Labs · 10.8.2026 · Mallit

Meta julkaisi kolmenkymmenen miljardin agenttimallin Apache 2.0:lla — ja mitoitti sen kahdenkymmenenneljän gigatavun näytönohjaimeen

Muse Glimmer on tislattu Muse Sparkista, näkee kuvia, kutsuu työkaluja ja toipuu epäonnistuneesta kutsusta. Neljän bitin kvantisoinnissa kielimalli painaa alle 20 gigatavua, ja mukana tulee lohkodiffuusioon perustuva luonnostelija, joka kolminkertaisti nopeuden RTX 5090:llä.

Muse Sparkopettajatislaus30BGlimmer24 GBalle 20 GBApache 2.0 · kuva + teksti sisään, teksti ulostietokatko 4.1.2026 · konteksti 131 072+

Meta Superintelligence Labs julkaisi tänään Muse Glimmerin ja avasi sen painot Apache 2.0 -lisenssillä. Malli on kolmenkymmenen miljardin parametrin tiheä kausaalitransformeri, jossa on oma havaintoenkooderi kuville, ja se on tislattu talon suuremmasta Muse Sparkista. Julkaisun ydinlause on tutkimusblogissa suora: malli on tarkoitettu jatkuvasti päällä oleviin paikallisiin agenttityönkulkuihin ja mitoitettu mahtumaan yhteen kuluttajanäytönohjaimeen.

Tarkat luvut mallikortista: kokonaisparametreja noin 29,6 miljardia, mistä havaintoenkooderi vie noin 1,8 miljardia. Kerroksia on 52, ja niiden tarkkaavaisuus vuorottelee kolme liukuvan ikkunan kerrosta ja yksi täysi kerros samassa rytmissä kolmetoista kertaa. Kysely- ja avainpäitä on 32 ja 2, eli yksi avain-arvopää palvelee kuuttatoista kyselypäätä ja KV-välimuisti kutistuu kuudennestoistaosaan. Konteksti on 131 072 tokenia tai enemmän, sanasto 202 048 tokenia, ja tietokatko on 4. tammikuuta 2026.

Kiinnostavin osa on muistibudjetti, koska se on kirjoitettu auki. Täydellä tarkkuudella kolmenkymmenen miljardin malli veisi yli 55 gigatavua. Meta kvantisoi kielimallin noin neljän bitin tarkkuuteen, jolloin se painaa alle 20 gigatavua — ja tilaa jää samaan aikaan KV-välimuistille, kuvaenkooderille ja luonnostelijalle 24 tai 32 gigatavun sisällä. Kaksi kvantisoitua versiota on julkaistu: K-Quant-Dynamic 32 gigatavun näytönohjaimelle, laatuhäviö 0,2 prosenttia, ja K-Quant-17GB 24 gigatavun kortille, laatuhäviö 1,0 prosenttia. Häviöt on mitattu viidentoista yleisen mittarin keskiarvona.

Nopeus tulee spekulatiivisesta dekoodauksesta, ja tässä on julkaisun tekninen uutuus. Mukana on kevyt luonnostelija, joka perustuu DFlash-menetelmään: se on lohkodiffuusiomalli, joka ennustaa kokonaisen kuudentoista tokenin lohkon yhdellä eteenpäinajolla, ja päämalli varmistaa ehdotukset rinnakkain. Metan omat mittaukset K-Quant-17GB-mallilla: RTX 5090 nousi 74,9 tokenista sekunnissa 233,4:ään eli 3,1-kertaiseksi, Apple M5 Max 26,6:sta 50,2:een eli 1,8-kertaiseksi ja M4 Max 23,7:stä 37,8:aan eli 1,5-kertaiseksi. Mac-luvut on mitattu ExecuTorchilla ja RTX-luku llama.cpp:llä, eräkoolla yksi ja ahneella dekoodauksella. Tämä lehti ei ole mitannut lukuja itse.

Kykyprofiili on agenttimallin profiili, ei keskustelumallin. Meta listaa koulutetuiksi ja mitatuiksi ominaisuuksiksi monivaiheisen tehtävän loppuunviennin, työkalukutsut tarkoilla skeemoilla, pitkän horisontin päättelyn, virheestä toipumisen — malli on opetettu diagnosoimaan epäonnistunut työkalukutsu ja yrittämään uudelleen sen sijaan että se pysähtyisi — sekä lomitetun tekstin ja kuvan lukemisen. Päättelyn voimakkuutta säädetään järjestelmäkehotteen rivillä, jossa lukee Reasoning strength ja arvo low, medium, high tai xhigh.

Vertailussa Metan taulukko ei kaunistele. Muse Glimmer voittaa Gemma4-31B:n ja Qwen3.6-27B:n selvästi agenttimittareissa: MCP Atlas 75,5 vastaan 54,2 ja 62,5, DeepSearch QA 74,6 vastaan 61,7 ja 71,1, SWE-Bench Pro 51,2 vastaan 36,9 ja 50,2. Mutta Qwen3.6-27B on parempi kahdeksassa mittarissa — muun muassa OSWorld-Verified 75,6 vastaan 65,9 ja TerminalBench 2.1 60,7 vastaan 51,7 — ja Gemma4-31B johtaa GPQA Diamondissa ja turvallisuusmittareissa. Kolmenkymmenen miljardin luokassa ei siis ole yhtä voittajaa, ja se on lukijalle hyvä uutinen.

Turvallisuuspuoli on avattu poikkeuksellisen tarkasti avoimen painon julkaisuksi. Meta toteaa, ettei Muse Glimmer täytä yhtiön oman kehyksen määritelmää rajamallista, koska se on Muse Sparkia heikompi, mutta arvioi sen silti varmuuden vuoksi: kemia ja biologia kohtalainen tai matalampi riski, kyber ja hallinnan menetys kohtalainen tai matalampi päättelemällä. Kemian ja biologian mittareissa malli jää pääosin Gemma4-31B:n taakse, mikä on julkaisun kannalta juuri se tulos, jota haettiin.

Paikallisajajalle merkitys on kaksitahoinen. Ensimmäinen: tämä on ensimmäinen kerta pitkään aikaan, kun suuri länsimainen laboratorio julkaisee painot lisenssillä, joka ei rajoita kaupallista käyttöä, ja mitoittaa mallin nimenomaan kuluttajarautaan sen sijaan että kutsuisi kahdeksankymmenen gigatavun palvelinkorttia kuluttajaraudaksi. Toinen: kahdenkymmenenneljän gigatavun raja on kova. Se sulkee ulos suuren osan mini-PC-kannasta, jonka jaettu muisti on kuusitoista gigatavua, ja se on syy siihen, miksi illan mini-PC-vertailussa on kaksi konetta luokan yläpuolelta.

Lisälähteet

Muut jutut tässä numerossa