Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Keskiviikko · 26. elokuuta 2026Iltapainos · klo 21Nro 54
← Takaisin etusivulle

Työkalut · ajomoottorit · MLX · Työkalut

Ollama sai illan uuden arkkitehtuurin ajoon samana päivänä — ja korjasi vian, joka kaatoi mallin lataamisen hitaalta levyltä

Versio 0.33.1 lisää Qwen3.8-Flash-Nextin tuen MLX-taustalle, tuo jäsennellyn ulostulon MLX-ajurille ja poistaa Metal-aikakatkaisun, joka iski juuri silloin kun malli ladattiin ulkoiselta levyltä. Ensimmäinen esiversio ilmestyi kolme tuntia ennen valmista.

Ollaman versio 0.33.0 ilmestyi keskiviikkoyönä, ja päivä olisi voinut jäädä siihen. Iltapäivällä kuitenkin julkaistiin esiversio 0.33.1-rc0 yhdellä ainoalla muutoksella otsikossaan — Qwen3.8-Flash-Nextin tuki MLX-taustalle — ja kolme tuntia myöhemmin valmis 0.33.1.

Valmiin version muutoslista on lyhyt mutta kertova. Uuden arkkitehtuurin tuen lisäksi MLX-ajuri sai jäsennellyn ulostulon, eli mallin vastauksen voi nyt pakottaa noudattamaan annettua rakennetta myös Applen laskentakehyksen kautta ajettaessa. Aiemmin se onnistui vain llama.cpp-taustalla, mikä pakotti valitsemaan nopeuden ja muodon välillä.

Kolmas kohta on pienen kuuloinen mutta iso käytännössä: MLX-ajuri ei enää aiheuta Metal-näytönohjaimen aikakatkaisua, kun mallia ladataan hitaalta tallennusvälineeltä. Tämä on juuri se tilanne, johon paikallista mallia ajava törmää useimmin — kymmenien gigatavujen painotiedostot eivät mahdu koneen sisäiselle levylle, ne siirretään ulkoiselle, ja lataaminen kestää niin kauan, että käyttöjärjestelmä päättää grafiikkapinon jumiutuneen.

Lisäksi ulkoisten yhteensopivuuspaikkojen käsittely tehtiin idempotentiksi käännösvaiheessa, eli sama paikka ei enää mene päälle kahdesti, ja MLX sekä llama.cpp päivitettiin uudempiin versioihin.

Käytännön varaus kannattaa lukea: uusi arkkitehtuuri kulkee toistaiseksi MLX:n kautta, ja MLX on Applen oma kehys. Muilla alustoilla malli odottaa yhä llama.cpp-tuen valmistumista.

Lisälähteet

Muut jutut tässä numerossa