Tekoälyn päivälehti — mallit, työkalut ja hardware
Intel · AutoRound · Qwen3.8-27B · 19.–20.8.2026 · Mallit
Kolme virallista Intel-kvantisointia Qwen3.8-27B:stä: GGUF-muotoiset q4km ja q2ks llama.cpp-maailmaan sekä AutoSchemen automaattisesti sekoittama 2,8 bitin resepti, jossa työkalu itse päättää kerroskohtaiset tarkkuudet. Piirijätit ovat ryhtyneet kvanttien kustantajiksi — ja se on paikallisajajan etu.
Intelin AutoRound-tiimi vei viime yönä Hugging Faceen kolme virallista kvantisointia Qwen3.8-27B:stä — mallista, jonka käännöksiä yhteisö on tähän asti tehtaillut sadoittain omin voimin. Kaksi uusinta ovat GGUF-muotoisia eli suoraan llama.cpp-, Ollama- ja LM Studio -maailman käytettävissä: tavallinen q4km ja tiukempi q2ks, molemmat tehty työkalun omalla parhaalla reseptillä. Jo tiistaina ilmestyi kolmas ja teknisesti kiinnostavin: 2,8 bitin sekoitekvantti, jonka on koostanut AutoRoundin uusi AutoScheme-automaatti.
AutoSchemen ajatus poikkeaa perinteisestä kvantisoinnista, jossa sama bittileveys jyrätään läpi koko mallin. Automaatti saa tavoitteeksi keskimääräisen bittimäärän — tässä 2,8 bittiä painoa kohti, skaalat ja nollapisteet mukaan laskettuna — ja päättää itse, mikä kerros sietää kovaa pakkausta ja mikä tarvitsee väljyyttä. Lopputulos on resepti, jollaisen virittäminen käsin on vaatinut kvantisointiharrastajilta viikkojen kokeilut. Intel toteaa suoraan myös varjopuolen: 2 ja 3 bitin laskentaytimet eivät toistaiseksi ole yhtä nopeita kuin 4 ja 8 bitin, joten pienin tiedosto ei automaattisesti tarkoita nopeinta ajoa.
Käyttöönotossa on yksi mutka: sekoitekvantin ajaminen vLLM:llä vaatii korjauksen, joka ei vielä ole ehtinyt viralliseen julkaisuun, joten mallikortti neuvoo asentamaan vLLM:n suoraan korjaushaarasta. GGUF-tiedostoilla vastaavaa estettä ei ole. Tuttuun tapaan tuoreen mallin ympärillä kaikki ei siis vielä ole valmista — mutta nämä ovat päivissä korjaantuvia pakkausviiveitä, eivät mallin ominaisuuksia.
Isompi kuva on merkillepantava: piirivalmistajista on tulossa kvanttien kustantajia. AMD julkaisi viime viikolla omat ONNX- ja NPU-käännöksensä samasta mallista, ja Intelin tuoreet GGUF:t tulevat talosta, joka kehittää sekä AutoRound-työkalua että SYCL-taustaa llama.cpp:hen. Paikallisajajalle tämä on pelkkää hyvää: virallinen kvantti on jäljitettävä, sen resepti on dokumentoitu, ja kun pakkaaja on sama taho, joka optimoi laskentaytimiä, luvuilla on takuumies. Yhteisön käännökset eivät katoa minnekään — mutta niiden rinnalle on ilmestynyt vertailukohta, johon niitä voi mitata.