Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Tiistai · 25. elokuuta 2026Iltapainos · klo 21Nro 53

Tiistaina paikallisen ajamisen katto nousi kahdesti. Apple esitteli aamupäivällä M5 Ultran, jonka pöytäkoneeseen mahtuu 512 gigatavua yhtenäistä muistia ja 1,2 teratavua sekunnissa kaistaa — ja mainitsi tiedotteessaan nimeltä LM Studion, ei omaa pilveään. Illalla Xiaomi näytti insinööriprototyypin, jonka oma piiri lukee muistia 1,22 teratavun sekuntivauhtia ja lupaa ajaa 200 miljardin parametrin mallia kotilaatikossa. Ohjelmistopuolella llama.cpp julkaisi version 0.3.0 ja opetti moniajon jakamaan tensorit eri kiihdyttimille, exllamav3 alkoi siirtää asiantuntijakerroksia keskusmuistiin lennossa, ja Tencent avasi kolme monimuotoista upotusmallia. Lisäksi: Windows sai piilotetun säätimen, jolla yhtenäisestä muistista voi varata palan mallille, videomalli jonka aiemmat versiot olivat avoimia hinnoiteltiin sekuntitaksalla, ja kaksi lähes identtistä mini-PC:tä joita erottaa vain yksi luku — jota kukaan ei mittaa samalla tavalla.

Laitteisto · Apple silicon · yhtenäinen muisti

Puoli teratavua muistia pöytäkoneeseen — ja Apple mainitsee tiedotteessaan LM Studion, ei omaa pilveään

M5 Ultra on Applen ensimmäinen neljän sirupalan piiri: jopa 36 suoritinydintä, 80 grafiikkaydintä, 512 gigatavua yhtenäistä muistia ja 1,2 teratavua sekunnissa kaistaa. Samalla Mac mini sai M6:n, jonka muistikatto on yhä 32 gigatavua. Ennakkotilaukset ovat auki, koneet lähtevät 22. syyskuuta — ja se yksi kokoonpano, jonka takia tätä luetaan, vasta lokakuun lopulla.

Lue pääjuttu →

Kokeilemisen arvoista

Kolme komentoa illan jutuista

Ensimmäinen asentaa Koodi-palstan kehyksen, joka sai uuden version samana päivänä kuin sen kohdealusta sai uuden piirin. Toinen lataa illan pienimmän monimuotoisen upotusmallin, joka koodaa tekstin, kuvan ja videon samaan vektoriin. Kolmas hakee Media-palstan puhesyntetisaattorin, joka ajetaan kokonaan suorittimella ilman näytönohjainta.

pip install -U mlx mlx-lm
hf download tencent/WeMM-Embedding-2B --local-dir wemm-2b
hf download Audio8/audio8-TTS-0.1B-ONNX-INT8 --local-dir audio8-onnx

Ensimmäinen komento toimii vain Applen piireillä; muilla alustoilla asennus menee läpi mutta kiihdytystä ei tule. Toinen lataa noin 5,4 gigatavua kuudentoista bitin painoja, ja mallin ajamiseen tarvitaan lisäksi transformers 5.2.0 sekä qwen-vl-utils — versiot on naulattu mallikortissa tarkasti, eivätkä uudemmat välttämättä toimi. Kolmas lataa kahdeksanbittiset ONNX-graafit, mutta pelkät tiedostot eivät riitä: ajokoodi, suoratoistopalvelin ja äänen rekisteröinti ovat projektin GitHub-repossa. Kaikki hf-komennot tulevat huggingface_hub-paketista (pip install -U huggingface_hub).