Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Perjantai · 28. elokuuta 2026Iltapainos · klo 21Nro 56

Perjantai-illan iso uutinen tuli Pekingistä: Z.ai avasi GLM-5.3:n painot, ja kyseessä on 753 miljardin parametrin malli, joka on koodaustesteissä avoimen painon kärjessä. Kotikoneella sitä ei aja kukaan — pienin pakattu versio vie 217 gigatavua — mutta samana päivänä Tencent julkaisi 770 miljardin parametrin Hy4:n Apache 2.0 -lisenssillä, ja kahden mallin arkkitehtuurit ovat hämmentävän samannäköiset. Kevyemmässä päässä ilta oli luonnostelun ilta: LM Studio oppi kolme eri tapaa antaa pienen mallin kirjoittaa ison puolesta, ja yksi kehittäjä julkaisi GLM-5.3-Flashille oman 1,2 miljardin parametrin luonnostelupään. Lisäksi: llama.cpp ajaa nyt Qwen 3.5:tä Intelin NPU:lla, Applen M5:lle tuli omat viritykset, venäjänkielisessä suoratoistopuhesyntetisaattorissa on alle puoli miljardia parametria — ja illan mini-PC-parissa on käytännössä sama siru kahdesti, mutta vain toisessa koneessa on kaksi muistikampaa.

Mallit · avoimet painot · koodaus

753 miljardin parametrin malli sai painonsa julki — ja se on koodaustesteissä avointen kärki

Z.ai julkaisi GLM-5.3:n painot perjantai-iltana kahden viikon rajapintakäytön jälkeen. Malli on sama pohja kuin edeltäjässään, mutta jälkikoulutus nosti sen Terminal Bench 3.0:ssa 4,6 pisteestä 28,3:een. Pienin pakattu versio vie 217 gigatavua, joten kotikoneen sijaan tämä on uutinen siitä, mikä avoimissa painoissa on nyt mahdollista.

Lue pääjuttu →

Mallit · luonnostelu · nopeus

Miljardin parametrin apuri kirjoittaa 320 miljardin parametrin mallin puolesta — ulkopuolinen kehittäjä julkaisi GLM-5.3-Flashille oman luonnostelupään

incoai-nimimerkin julkaisema DFlash2-malli on 1,17 miljardia parametria ja perustuu Qwen3-runkoon. Se ei tee mitään yksinään: sen tehtävä on ehdottaa seuraavat tokenit, jotka iso malli tarkistaa yhdellä kertaa. Muutamaa tuntia aiemmin samana päivänä llama.cpp oli saanut saman tekniikan tuen.

Lue juttu →

Kokeilemisen arvoista

Kolme komentoa illan jutuista

Ensimmäinen asentaa Koodi-palstan puheentunnistuskirjaston, joka pudotti tänään yhden raskaan riippuvuuden pois. Toinen hakee illan luonnostelupään, jolla iso malli kirjoittaa nopeammin. Kolmas päivittää Intelin ajokirjaston siihen versioon, jonka llama.cpp otti tänään käyttöön.

pip install -U 'funasr[knf]==1.4.5' && python -c 'import funasr; print(funasr.__version__)'
hf download incoai/GLM-5.3-Flash-DFlash2 --local-dir glm53-flash-dflash2
pip install -U 'openvino-genai==2026.3.1.0' && python -c 'import openvino_genai as g; print(g.__version__)'

Ensimmäinen komento asentaa FunASRin niin, että torchaudiota ei tarvita: hakasulkeissa oleva knf hakee tilalle kevyemmän kaldi-native-fbank-piirreirrottimen. Jos sinulla on jo torchaudio-pohjaisia työnkulkuja, ne toimivat entiseen tapaan, kunhan torchaudio on erikseen asennettuna. Toinen lataa noin 1,2 miljardin parametrin luonnostelumallin; se on hyödytön yksinään ja tarkoitettu ajettavaksi GLM-5.3-Flashin rinnalla, eikä sen lisenssi salli kaupallista käyttöä. Kolmas päivittää OpenVINOn generatiivisen rajapinnan; itse llama.cpp-tuki tulee erillisenä OpenVINO-käännöksenä, joka on ladattavissa projektin julkaisusivulta Windowsille ja Ubuntulle, eikä sitä siis saa pip-asennuksella.