Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Torstai · 13. elokuuta 2026Iltapainos · klo 21Nro 41
← Takaisin etusivulle

vLLM · 0.27.1 ja 0.27.2rc0 · 11.–12.8.2026 · Työkalut

vLLM hioi DSparkia kaksi julkaisua peräkkäin — kvantisoidut luonnospäät ja varmistus, joka säätää itse itseään

Versio 0.27.1 toi tuen kvantisoiduille DSpark-luonnospäille, ja seuraavan version ensimmäinen kandidaatti rakentaa varmistuksen, joka aikatauluttaa itsensä luonnoksen varmuuden mukaan. Kaksi päivää myöhemmin DeepSeek julkaisi mallin, jossa DSpark on vakiovaruste.

vLLM 0.27 -sarja0.27.010.8. · 561 committia0.27.1kvantisoidut päät0.27.2rc0itsesäätyvä varmistus13.8.: DeepSeek-V4-Pro-0813 + DSparkluonnos ja päämalli samassa checkpointissa

vLLM:n 0.27.0 valmistui sunnuntaina 561 commitin ja 242 tekijän voimin, ja sen näkyvin otsikko oli Kimi K3:n koko pinon tuki. Mutta kiinnostavampi juonne kulkee kahdessa sitä seuranneessa julkaisussa. Maanantain 0.27.1 on yhden asian paikkausversio: tuki kvantisoiduille DSpark-Markov-päille. Ja tiistain 0.27.2rc0-kandidaatti kantaa otsikossaan muutosta nimeltä DSpark confidence-scheduled verification — varmistus, joka aikatauluttaa itsensä luonnoksen varmuuden mukaan.

Termit ansaitsevat avaamisen. DSpark-mallissa luonnostelu ei tapahdu erillisellä pienoismallilla vaan päämallin sisään koulutetulla moduulilla, jonka tilasiirtymiä kuvataan Markov-päällä. Kun itse malli ajetaan kvantisoituna — ja käytännössä kaikki paikallinen ja suuri osa palvelinajosta ajetaan — luonnospään on tähän asti pitänyt pyöriä täydellä tarkkuudella. 0.27.1:n jälkeen ei tarvitse: pää kulkee samassa kvantisointimuodossa muun mallin kanssa, mikä säästää muistia ja poistaa yhden erikoistapauksen.

Itsesäätyvä varmistus taas puuttuu spekulatiivisen dekoodauksen perusjännitteeseen. Jokainen luonnostoken pitää varmistaa päämallilla, ja varmistuserän koko on kompromissi: liian pitkä erä haaskaa laskentaa vääriksi osoittautuviin tokeneihin, liian lyhyt jättää nopeushyötyä pöytään. Uusi mekanismi lukee luonnosmoduulin omaa varmuutta ja venyttää tai lyhentää erää sen mukaan. Ajatus on sama, jonka DeepSeek esitteli omissa DSpark-papereissaan: luonnostelija tietää itse, milloin se on epävarma, ja sitä tietoa kannattaa käyttää.

Ajoituksen ironiaa ei voi ohittaa: kaksi päivää näiden julkaisujen jälkeen DeepSeek toi ulos lippulaivansa, jossa DSpark on sisäänrakennettuna, ja mallikortin vLLM-esimerkkikomento kytkee sen päälle yhdellä lipulla. Julkaisujen järjestys tuskin on sattumaa — vLLM:n DSpark-työhön on osallistunut väkeä, joka on nähnyt mallin ennen muita. Paikallisajajan kannalta olennaista on, että sama koodipolku palvelee myös pienempiä DSpark-luonnoksia, joita DeepSeek on julkaissut Qwen3- ja Gemma4-perheille.

Julkaisumuistiossa on vielä yksi aikamme kuva: 0.27.2rc0:n tekijälistalla ovat allekirjoittajina kaksi ihmistä — ja rinnakkaistekijöinä OpenAI Codex sekä Claude Opus 5. Päättelymoottorin spekulatiivista dekoodausta kehittävät nyt työkalut, jotka itse pyörivät sen kaltaisten moottoreiden päällä. Kehä on sulkeutunut, eikä kukaan tuntunut pitävän sitä edes mainitsemisen arvoisena.

Lisälähteet

Muut jutut tässä numerossa