Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Tiistai · 11. elokuuta 2026Iltapainos · klo 21Nro 39
← Takaisin etusivulle

lodestones · Kroma v0.2 · 9.8.2026 · Media

LoRA-kerros katosi työnkulusta: kuvamallin hienosäätö tuli ulos täytenä tarkistuspisteenä — ja kvantisoituna se mahtuu kahteentoista gigatavuun

Kroma v0.2 on Krea 2:n täysi hienosäätö, ei enää päälle ladattava sovitin. Turbo-variantti painaa 25,6 gigatavua, yhteisön INT8-versio noin 14 ja neljän bitin versio mahtuu kahdentoista gigatavun näytönohjaimeen ilman siirtoja.

v0.1Krea 2 -pohjaLoRA rank-256.diff-deltatv0.2yksi tiedosto25,6 GB turboyhteisökvantit: INT8 ~14 GB · w4a8 mahtuu 12 GiB:iin8–12 askelta · CFG 1,0–1,5 · shift 1,15

Kuvamallien paikallisessa ajamisessa on tapa, joka on niin vakiintunut ettei sitä enää huomaa: hienosäätöä ei jaeta mallina vaan sovittimena. Käyttäjä lataa pohjamallin, lataa päälle LoRA-tiedoston, ja työnkulkuun ilmestyy latausnoodi, jonka painoarvoa säädetään liukurilla. Se on tilaa säästävää mutta hauras järjestely, koska pohjan ja sovittimen versiot on pidettävä synkassa ja työnkulku täyttyy solmuista.

Lodestones julkaisi lauantaina 9. elokuuta Kroma v0.2:n, ja se purkaa tuon järjestelyn. Versio 0.1 oli rank-256-kokoinen LoRA ja joukko .diff-deltoja, jotka ladattiin Krea 2 -pohjan päälle. Versio 0.2 on täysi hienosäädetty tarkistuspiste. LoraLoader-solmu poistuu työnkulusta kokonaan, ja tiedosto ladataan tavallisena diffuusiomallina. Krea 2 Turbon delta on sulautettu sisään rank-512-kokoisena LoRA:na, joten yksi tiedosto antaa sekä hienosäädetyn laadun että Turbo-nopeuden.

Jakelussa on kaksi varianttia. Perusversio kroma-v0.2-base.safetensors painaa noin 51,3 gigatavua ja turbo-versio kroma-v0.2-turbo.safetensors noin 25,6 gigatavua. Kumpikaan luku ei ole kotikoneen näytönohjaimen kokoluokkaa sellaisenaan, ja siksi kiinnostavin osa julkaisua on se, mitä sen ympärille on jo ehtinyt syntyä. Silveroxidesin INT8-convrot-variantit painavat noin 14 gigatavua, ja Civitaissa julkaistu w4a8 XL -versio on viritetty mahtumaan kahdentoista gibitavun näytönohjainmuistiin ilman siirtoja keskusmuistiin.

Paikallinen ajo tapahtuu ComfyUI:n natiivilla Krea 2 -tuella, eikä siihen tarvita lisäosia. Diffuusiomalli menee kansioon models/diffusion_models, tekstienkooderi ladataan CLIPLoader-solmulla tyypillä krea2 — se on Krea 2:n oma Qwen3-VL-pohjainen kaksitoistakerroksinen pino — ja Krea 2:n VAE ladataan erikseen. Näytteistysasetukset on tislattu Turbolle: kahdeksasta kahteentoista askelta, ohjausvoimakkuus CFG välillä 1,0–1,5 ja siirtoparametri mu arvoon 1,15.

Lisenssistä on kerrottava tarkasti, koska mallikortti antaa siitä kaksi eri vastausta. Kortin teksti sanoo hienosäädön olevan MIT-lisenssin alainen. Hugging Face -varaston lisenssitagi puolestaan on krea-2-community-license, ja kortti toteaa nimenomaisesti, että Krea 2:ta hallitsee sen oma lisenssi eikä tämä hienosäätö anna mitään oikeuksia pohjapainoihin. Käytännön tulkinta: MIT koskee sitä, mitä lodestones on itse tehnyt; pohjamallin ehdot pysyvät voimassa. Jos aiot käyttää mallia kaupallisesti, lue Krea 2:n yhteisölisenssi ennen kuin luet mitään muuta.

Parametrimäärää ei mallikortissa kerrota, eikä sitä pidä arvata. Tiedostokoot ovat se, mitä on julkaistu, ja ne riittävät muistibudjetin arviointiin. Yleisemmin tämä julkaisu on hyvä muistutus siitä, että kuvapuolella tapahtuu tällä hetkellä sama kuin kielimallipuolella: laatu tulee hienosäädöstä ja saatavuus kvantisoinnista, ja ne kaksi tehdään eri porukoissa. Malli julkaistaan täytenä, yhteisö kutistaa sen kuluttajarautaan, ja vasta se jälkimmäinen vaihe ratkaisee, ajetaanko mallia oikeasti jossain.

Lisälähteet

Muut jutut tässä numerossa