Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Lauantai · 22. elokuuta 2026Iltapainos · klo 21Nro 50

Lauantai toi harvinaisen selkeän pääuutisen: Ollama julkaisi aamuyöllä version 0.33, jonka myötä paikallisen mallin voi kytkeä työpöytäsovelluksiin suoraan valikosta — ja ensimmäisenä kytkettävien listalla on Anthropicin Claude. Samalla viikolla OpenAI vei ChatGPT:n Macin Viestit-sovellukseen, joten suunta on molemmilla sama ja kysymys yhteinen: kuka istuu sovellustesi ja tekstiesi välissä. Paikallisessa kytkennässä vastaus on tylsin mahdollinen, ja juuri siksi se kiinnostaa. Kiinalainen RedNote teki viikonlopusta omansa kahdella avauksella: eilen llama.cpp sai tuen sen teksti-, kuva- ja äänimalli dots3-notelle, ja tänään saman talon FireRed-tiimi avasi 9 miljardin parametrin äänimallin, joka kuuntelee, puhuu ja editoi puhetta yhdellä verkolla. Google puolestaan kertoi Gemma-perheen ylittäneen miljardin latauksen — ja kiinnostavin luku ei ole miljardi vaan satatuhatta yhteisön julkaisemaa varianttia. Mittarijutussa 18 kärkimallia pantiin tekemään tutkimusta ilman ihmistä, ja avoin Kimi K3 ylsi 10 askeleen päähän suljetusta kärjestä. Nvidia osti Poolsidesta kaiken paitsi yhtiön, mikä jättää kesän kehutuimman avoimen koodimallin jatkon auki. Illan vertailussa GEEKOMin 699 euron Intel kohtaa saman talon 447 euron AMD:n — ja lukija saa vastauksen siihen, mitä 252 euron välierolla oikeasti saa.

Sovellukset tulevat mallin luoOllamapaikallinen malliClaudeCodex · Zed · ClineVS Code · GooseConnect your apps — kytkentä valikosta, ei komentoriviltä

Ollama 0.33.0 · 22.8.2026

Ollama 0.33 kytkee paikallisen mallin työpöytäsovelluksiin — ensimmäisenä listalla on Claude

Aamuyöllä julkaistun version näkyvin uudistus on työpöytäsovelluksen uusi Connect your apps -osio: paikallisen mallin voi kytkeä muihin sovelluksiin suoraan valikosta, ja ensimmäisenä kytkettävänä on Anthropicin Claude-työpöytäsovellus. Sama liike näkyy samalla viikolla toiseen suuntaan — OpenAI vei ChatGPT:n Macin Viestit-sovellukseen.

Lue pääjuttu →

Teksti, kuva ja ääni — yksi mallitekstikuvaääni288 mrd parametria — 8 + 1 asiantuntijaa kerrallaanllama.cppmtmd-tuki

dots3-note · llama.cpp · RedNote

llama.cpp oppi katsomaan ja kuuntelemaan RedNoten jättimallia — dots3-note sai tuen eilen illalla

Kiinalaisen RedNoten dots-tiimin dots3-note ottaa vastaan tekstiä, kuvaa ja ääntä samalla Apache-lisensoidulla mallilla. Nyt llama.cpp:n multimodaalikerros tukee sitä — ja 288 miljardin parametrin kokonaisuudesta on kerrallaan hereillä vain noin 16 miljardin siivu.

Lue juttu →

Vähemmän askelia on parempiIhmisetOpus 5Kimi K3GPT-5.6 Sol2 6002 9202 9303 042Punainen on ainoa, jonka painot voi ladata itse.

Prime Intellect · nanoGPT-speedrun

18 mallia pantiin tekemään tutkimusta ilman ihmistä — avoin Kimi K3 ylsi 10 askeleen päähän kärjestä

Prime Intellect ajoi 153 täysin autonomista tutkimusajoa, joissa kärkimallit yrittivät nopeuttaa nanoGPT-koulutusta kahdeksan H200-näytönohjaimen hiekkalaatikossa jopa 8 päivää kerrallaan. Suljettu kärki piti pintansa, mutta avoimen painon Kimi K3 ohitti GPT-5.6 Solin — ja ihmisten ennätys kesti kaiken.

Lue juttu →

Luonnos lohkoina, vahvistus kerrallaluonnostelija ehdottaa lohkonvahvistusvLLMllama.cpp (DSpark)mistral.rs 0.9.2+ kvantisoitu luonnostelijaSama idea, kolme toteutusta — viikossa

mistral.rs v0.9.2 · Rust

mistral.rs otti lohkoluonnostelun käyttöön — yhden kehittäjän moottori ehti ennen useimpia isoja

Rust-kielinen ajomoottori sai torstaina version 0.9.2, joka tukee DFlash 2 -lohkoluonnostelua, kvantisoitua luonnostelijaa ja CUDA-graafien eräkokoluokkia. Viikon takainen tutkimusidea pyörii nyt kolmannessa moottorissa — ja pienin ehti lähes ensimmäisenä.

Lue juttu →

Osto ilman ostamistaPoolsideLaguna XS 2.1 (avoin)Nvidialisenssi → 6 mrd $sijoitus ← 1 mrd $109 työtarjousta →Yhtiö jää — mutta jääkö avoin malliperhe?Newcomerin tietoja, osapuolet eivät ole vahvistaneet

Nvidia · Poolside · raportoitu diili

Nvidia osti Poolsidesta kaiken paitsi yhtiön — avoimen Laguna-mallin kohtalo jäi auki

Newcomer-uutiskirjeen mukaan Nvidia maksaa 6 miljardia dollaria ei-yksinomaisesta teknologialisenssistä, sijoittaa miljardin lisää ja tekee työtarjouksen 109 Poolsiden työntekijälle. Kesän kehutuin avoin koodimalli Laguna XS 2.1 on saman talon tuote — ja sen jatko on nyt aidosti epävarma.

Lue juttu →

Kuuntele — ymmärrä — puhu — editoiFireRedAudio9 mrd · Apache 2.0puhe sisäänpuhe ulos — myös editoitunaYmmärrys ja generointi eriytetty omiin polkuihinsa

FireRedAudio · Apache 2.0 · 22.8.2026

Yksi malli kuuntelee, puhuu ja editoi puhetta — RedNote avasi FireRedAudion painot tänään

FireRedAudio on Apache-lisensoitu 9 miljardin parametrin äänimalli, joka yhdistää puheentunnistuksen, äänen ymmärtämisen, nollanäytteisen puhesynteesin ja puheen editoinnin samaan verkkoon. Painot ovat Hugging Facessa: 21 gigatavua mallia ja 8,4 gigatavun dekooderi.

Lue juttu →

Kaksi ovea, molemmat aukivastausaineistostaEN TIEDÄsallittu ja tarkistettavakäytä sellaisenaaneskaloi tai kysy lisää

Päivän promptivinkki

Anna pienelle mallille lupa olla tietämättä — yksi rivi karsii keksittyjä vastauksia

Pieni paikallinen malli vastaa mieluummin väärin kuin jättää vastaamatta, koska sitä on koulutettu olemaan avulias. Illan vinkki rakentaa kehotteeseen ulospääsyn: tietämättömyydestä tehdään sallittu ja täsmälleen muotoiltu vastaus, jonka koodi voi napata kiinni.

Lue juttu →

Sama malli, kutistuva jalanjälkiBF16100 %4-bit~25 %3-bit~19 %kalibrointiaineisto ohjaa, mitkä painot saavat tarkkuuttaCUDA · ROCm · Ascend · Intel XPU · CPU

Päivän Python-kirjasto

GPTQModel 7.3.4: kirjasto, jolla teet kvantit itse — myös malleille, joita kukaan muu ei pakkaa

Valmiita kvantisointeja odotellaan yhteisön pakkaajilta joskus päiväkausia. GPTQModel on työkalu, jolla painot puristaa itse 4:ään tai 3:een bittiin omalla koneella — ja viikon versio korjasi monen näytönohjaimen kalibroinnin ja pienimmän bittileveyden puskurit.

Lue juttu →

Eri koneet, sama kapea käytäväIT13 · 12 ydintä699 €A5 2025 · 6 ydintä447 €1 kampa · 25,6 GB/s1 kampa · 25,6 GB/s=generointinopeus on käytävän, ei moottorin, mitta

Mini-PC-vertailu · alle 1 000 euron luokka · budget mini-PC

GEEKOM IT13 vastaan GEEKOM A5 2025 — Intelin monitoimikone kohtasi AMD:n arkirengin, ja molemmat juoksevat samaa kapeaa käytävää

Illan parissa on saman talon kaksi ääripäätä: 699 euron IT13 tarjoaa 12 ydintä, teratavun levyn ja Intel-laskentapinon, 447 euron A5 2025 kuusi vanhempaa ydintä ja pienimmän laskun. Paikallisen tekoälyn kannalta ne ovat silti kaksoset — kummankin muisti kulkee yhtä DDR4-kampaa pitkin.

Lue juttu →

Kokeilemisen arvoista

Kolme komentoa, jotka jatkavat suoraan illan uutisista

Ensimmäinen komento liittyy pääjuttuun: se käynnistää Claude Code -työkalun niin, että sen takana pyörii oma paikallinen mallisi Ollaman kautta. Toinen asentaa Koodi-palstan kvantisointityökalun tuoreen version. Kolmas lataa Media-palstan uuden äänimallin painot omalle koneelle odottamaan, että ehdit kokeilla.

ollama launch claude
pip install -U gptqmodel
hf download FireRedTeam/FireRedAudio --local-dir fireredaudio

Ensimmäinen komento vaatii Ollaman version 0.14 tai uudemman ja Claude Coden; valitse malli, jolle riittää vähintään 64 000 tokenin konteksti, tai anna Ollaman suositella. Toinen komento vetää mukanaan PyTorchin, joten ensiasennus on iso, ja itse kvantisointi kannattaa aloittaa pienestä mallista. Kolmas lataa noin 30 gigatavua — hf-komento tulee huggingface_hub-paketista (pip install -U huggingface_hub), ja mallin ajaminen vaatii toistaiseksi PyTorchin ja mieluiten 24 gigatavun näytönohjaimen, sillä kvantisoituja versioita ei vielä ole.