Tekoälyn päivälehti — mallit, työkalut ja hardware
Lauantai · 15. elokuuta 2026Iltapainos · klo 21Nro 43
Eilen tuli malli. Tänään tuli se, mikä mallin ympärille rakennetaan. DeepSeek avasi MIT-lisenssillä agenttirungon, jota se on itse käyttänyt omien malliensa mittaamiseen — ja jonka jokainen osa, myös malliyhteys, on vaihdettava liitännäinen. Se tarkoittaa käytännössä yhtä asiaa: sama runko, jolla ajetaan pilvimallia, ajaa myös sitä llama-serveriä, joka pyörii olohuoneessa.
Illan toinen löydös tuli hiljaa PyPI:stä. Eilen aamuyöllä ilmestyi paketti nimeltä flm-add, ja sen mukana ensimmäinen julkinen mittaussarja siitä, mitä AMD:n NPU tekee neljän miljardin parametrin mallilla — ei valmistajan TOPS-lukuja vaan tokeneita sekunnissa, kuudessa kontekstipituudessa, keskihajonnat mukaan lukien. Luvut eivät ole imartelevia, ja juuri siksi ne ovat arvokkaita.
Ja sitten on se, mistä tämä lehti kirjoittaa mielellään: Coherelle jäi mallikorttiin ohje asentaa transformers suoraan Gitistä, koska se versio, jota malli vaatii, ei ole vielä olemassa. Kolmen kappaleen juttu siitä, mitä tapahtuu kun mallit julkaistaan nopeammin kuin kirjastot.
Rehellisyyden nimissä: tämä on kymmenen jutun numero, ja se on kymmenen jutun numero siksi, että aineistoa oli tasan siihen. Neljäntoista kielen hakukierros oli tänään laihin pitkään aikaan — saksa, ruotsi, norja, tanska, ranska, viro, latvia, liettua, hindi ja turkki eivät tuottaneet ainuttakaan tuoretta löydöstä. Japani pelasti illan.
DeepSeek Harness v0.1 tuli ulos MIT-lisenssillä kehittäjien esiversiona. Runko on rakennettu Cordis-kehyksen päälle periaatteella, jossa malli, työkalut, taidot, istunnot, hiekkalaatikko, silmukat ja käyttöliittymä ovat kaikki vaihdettavia osia. Malliliitännän voi osoittaa mihin tahansa OpenAI-yhteensopivaan päätepisteeseen.
North Micro Vision Instruct on 2,4 miljardin parametrin avoimen painon näkömalli Apache 2.0 -lisenssillä, ja se lukee kuvat natiivissa tarkkuudessaan. Mallikortti vaatii transformers 5.16.0:n. PyPI:ssä uusin on 5.15.0, julkaistu 10. elokuuta.
Unslothin PyPI-historia kertoo julkaisutahdin, jota harva riippuvuus pitää: 2026.8.11 maanantaina, 2026.8.18 eilen. Kaksi viimeisintä ilmestyivät eilen kello 14.26 ja 15.00 — samana päivänä, saman tunnin sisällä.
Eilen aamuyöllä PyPI:hin ilmestyi flm-add 0.1.0, työkalu joka rekisteröi valmiin Q4NX-mallin FastFlowLM:lle. Mukana tuli mittaussarja Ryzen AI 340 -kannettavalta: esitäyttö 364–467 tokenia sekunnissa, tuotanto 13,2 tokenia sekunnissa tuhannen tokenin kontekstilla ja 5,2 kolmenkymmenenkahden tuhannen.
Intelligent Terminal 0.2 lisäsi paikallisten mallien tuen, joka oli käyttäjien eniten toivoma ominaisuus. Asetuksista löytyy BYOM-palveluntarjoaja, johon syötetään perus-URL ja mallin tunnus; tuettuna Ollama ja mikä tahansa OpenAI-yhteensopiva palvelin.
Googlen oman julkaisumuistion mukaan 3.7 Flash on yhtiön älykkäin työjuhtamalli koodaukseen ja agentteihin. Edeltäjä 3.6 Flash julkaistiin kolme viikkoa sitten. Paikallisajajalle tämä on hintapiste, jota vasten oma sähkölasku mitataan.
Avoimen painon musiikkigeneraattori julkaistiin viikko sitten Apache 2.0 -lisenssillä diffusers-muodossa. Eilen aamupäivällä ilmestyi GGUF-sarja: täysi F16 on 4,98 gigatavua, Q4_K_M 1,49 ja pienin Q3_K_M 1,16.
Työkalun kuvauskenttä on paikka, johon kirjoitetaan proosaa. Pieni malli lukee sen huonosti. Sama kenttä täytettynä yhdellä konkreettisella esimerkkikutsulla ja yhdellä muutosohjeella tuottaa kelvollisia kutsuja huomattavasti useammin.
Paikallisen haun vaikein osa ei ole malli vaan se, mitä mallille syötetään. Docling jäsentää PDF:t, Office-tiedostot, sähköpostit, EPUBit ja äänitiedostot yhteen esitysmuotoon. Uusin versio 2.120.1 ilmestyi eilen kello 11.51.
Minisforumin MS-02 Ultra maksaa 1 899 euroa ja lukee muistia 76,8 gigatavua sekunnissa kolmestakymmenestäkahdesta gigatavusta. Saman talon AtomMan G1 Pro maksaa 1 699 ja lukee 448 gigatavua sekunnissa kahdeksasta. Algoritmi antaa 12,96 ja 13,18. Kolmatta tietä ei tässä hintaluokassa juuri ole.
Aja illan agenttirunko ilman asennusta, tarkista onko odotettu kirjastoversio jo olemassa, ja asenna työkalu, joka vie mallin NPU:lle
Kolme komentoa tästä vuorokaudesta. Ensimmäinen käynnistää DeepSeekin eilen avaaman agenttirungon suoraan npm-rekisteristä ilman pysyvää asennusta. Toinen vastaa illan Mallit-jutun kysymykseen yhdellä rivillä: onko transformers 5.16.0 jo ulkona vai ei. Kolmas asentaa eilen aamuyöllä julkaistun työkalun, jolla NPU-mallin saa FastFlowLM-rekisteriin.
Ensimmäinen komento noutaa ja käynnistää DeepSeek Harnessin selainkäyttöliittymän. Kyseessä on kehittäjien esiversio, ja DeepSeek varoittaa itse rikkovista muutoksista — npx on siksi järkevämpi kuin globaali asennus. Malliyhteyden voi osoittaa mihin tahansa OpenAI-yhteensopivaan päätepisteeseen, eli myös omaan llama-serveriin. Toinen komento kysyy PyPI:n rajapinnalta transformersin uusimman version numeron. Tätä kirjoitettaessa vastaus on 5.15.0, joka julkaistiin 10. elokuuta — ja se on koko illan Mallit-jutun ydin, koska Coheren uusi näkömalli vaatii version 5.16.0. Kun komento jonain päivänä palauttaa 5.16.0, mallin voi asentaa PyPI:stä eikä Gitistä. Kolmas komento asentaa flm-add-työkalun, joka rekisteröi valmiiksi käännetyn Q4NX-mallin FastFlowLM:lle. Se ei tee mitään ilman AMD:n XDNA2-NPU:ta ja XRT-pinoa, joten sen asentaminen muulle koneelle on harmitonta mutta hyödytöntä.