Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Lauantai · 15. elokuuta 2026Iltapainos · klo 21Nro 43

Eilen tuli malli. Tänään tuli se, mikä mallin ympärille rakennetaan. DeepSeek avasi MIT-lisenssillä agenttirungon, jota se on itse käyttänyt omien malliensa mittaamiseen — ja jonka jokainen osa, myös malliyhteys, on vaihdettava liitännäinen. Se tarkoittaa käytännössä yhtä asiaa: sama runko, jolla ajetaan pilvimallia, ajaa myös sitä llama-serveriä, joka pyörii olohuoneessa. Illan toinen löydös tuli hiljaa PyPI:stä. Eilen aamuyöllä ilmestyi paketti nimeltä flm-add, ja sen mukana ensimmäinen julkinen mittaussarja siitä, mitä AMD:n NPU tekee neljän miljardin parametrin mallilla — ei valmistajan TOPS-lukuja vaan tokeneita sekunnissa, kuudessa kontekstipituudessa, keskihajonnat mukaan lukien. Luvut eivät ole imartelevia, ja juuri siksi ne ovat arvokkaita. Ja sitten on se, mistä tämä lehti kirjoittaa mielellään: Coherelle jäi mallikorttiin ohje asentaa transformers suoraan Gitistä, koska se versio, jota malli vaatii, ei ole vielä olemassa. Kolmen kappaleen juttu siitä, mitä tapahtuu kun mallit julkaistaan nopeammin kuin kirjastot. Rehellisyyden nimissä: tämä on kymmenen jutun numero, ja se on kymmenen jutun numero siksi, että aineistoa oli tasan siihen. Neljäntoista kielen hakukierros oli tänään laihin pitkään aikaan — saksa, ruotsi, norja, tanska, ranska, viro, latvia, liettua, hindi ja turkki eivät tuottaneet ainuttakaan tuoretta löydöstä. Japani pelasti illan.

Cordis-ydin: vain liitännäisten hallintaCordisMalliTyökalutTaidotIstunnotHiekkalaatikkoTallennusSilmukatKäyttöliittymäMIT · kehittäjien esiversio

DeepSeek · GitHub · 13.–14.8.2026

DeepSeek avasi agenttirungon, jossa myös malli on liitännäinen — ja juuri se tekee siitä paikallisajajan työkalun

DeepSeek Harness v0.1 tuli ulos MIT-lisenssillä kehittäjien esiversiona. Runko on rakennettu Cordis-kehyksen päälle periaatteella, jossa malli, työkalut, taidot, istunnot, hiekkalaatikko, silmukat ja käyttöliittymä ovat kaikki vaihdettavia osia. Malliliitännän voi osoittaa mihin tahansa OpenAI-yhteensopivaan päätepisteeseen.

Lue pääjuttu →

Malli julkaistiin ennen kirjastoaMallikortti vaatiitransformers 5.16.0PyPI:ssä uusin5.15.0 · 10.8.Ohje: uv pip install "git+https://github.com/huggingface/transformers.git"2,4 mrd parametria · Apache 2.02B kielimalli + 400M näkökooderi · 11 kieltä · natiivi kuvatarkkuusLM-konteksti 128K · monimodaalinen validoitu 8K

Cohere Labs · Hugging Face · 14.8.2026

Coheren uusi näkömalli vaatii transformers-version, jota ei ole olemassa — asennusohjeessa lukee: hae Gitistä

North Micro Vision Instruct on 2,4 miljardin parametrin avoimen painon näkömalli Apache 2.0 -lisenssillä, ja se lukee kuvat natiivissa tarkkuudessaan. Mallikortti vaatii transformers 5.16.0:n. PyPI:ssä uusin on 5.15.0, julkaistu 10. elokuuta.

Lue juttu →

unsloth PyPI:ssä 10.–14.8.202610.8.11.8.13.8.14.8.34 min8 versiota · 5 päivää2026.8.11 → 2026.8.18

Unsloth · PyPI · 10.–14.8.2026

Kahdeksan julkaisua viidessä päivässä ja kaksi niistä 34 minuutin välein — mitä se tekee sille, joka kiinnittää version

Unslothin PyPI-historia kertoo julkaisutahdin, jota harva riippuvuus pitää: 2026.8.11 maanantaina, 2026.8.18 eilen. Kaksi viimeisintä ilmestyivät eilen kello 14.26 ja 15.00 — samana päivänä, saman tunnin sisällä.

Lue juttu →

DynaGuard-4B Q4NX · AMD XDNA2 · tokenia/s1k2k4k8k16k32kesitäyttö 268–467 t/stuotanto 5,2–13,2 t/spainot 3,3 GB · vaatii n. 16 GB yhteismuistia

FastFlowLM · Hugging Face · PyPI · 14.8.2026

AMD:n NPU sai eilen ensimmäisen kunnollisen mittaussarjansa — ja se lukee kehotteen nopeasti mutta kirjoittaa hitaasti

Eilen aamuyöllä PyPI:hin ilmestyi flm-add 0.1.0, työkalu joka rekisteröi valmiin Q4NX-mallin FastFlowLM:lle. Mukana tuli mittaussarja Ryzen AI 340 -kannettavalta: esitäyttö 364–467 tokenia sekunnissa, tuotanto 13,2 tokenia sekunnissa tuhannen tokenin kontekstilla ja 5,2 kolmenkymmenenkahden tuhannen.

Lue juttu →

Asetukset → AI-agentti → BYOMIntelligent Terminal/agent/move/sessions0.2 · ilmainenPaikallinen palvelinOllamallama-servervLLM / LM StudioOpenAI-yhteensopivaURLVerkoton agenttityö Windowsissaagentti per välilehti · WSL-profiilikohtainen ajo

Microsoft · Windows · 14.8.2026

Microsoftin agenttipääte oppi puhumaan omalle koneelle — BYOM-kenttään kirjoitetaan Ollaman osoite

Intelligent Terminal 0.2 lisäsi paikallisten mallien tuen, joka oli käyttäjien eniten toivoma ominaisuus. Asetuksista löytyy BYOM-palveluntarjoaja, johon syötetään perus-URL ja mallin tunnus; tuettuna Ollama ja mikä tahansa OpenAI-yhteensopiva palvelin.

Lue juttu →

Flash-linjan julkaisuväli3.6 Flashn. 23.7.20263.7 Flash13.8.2026kolme viikkoatutustumishinta voimassa 31.12.2026 asti

Google · Gemini API · 13.8.2026

Gemini 3.7 Flash on yleisesti saatavilla, ja tutustumishinta on voimassa vuoden loppuun — mittatikku siirtyi taas

Googlen oman julkaisumuistion mukaan 3.7 Flash on yhtiön älykkäin työjuhtamalli koodaukseen ja agentteihin. Edeltäjä 3.6 Flash julkaistiin kolme viikkoa sitten. Paikallisajajalle tämä on hintapiste, jota vasten oma sähkölasku mitataan.

Lue juttu →

MiniMax-Music3 GGUF · tiedostokokoF164,98Q8_02,70Q6_K2,12Q5_K_M1,79Q4_K_M1,49Q3_K_M1,16gigatavua · Apache 2.0 · ComfyUI-työnkulku

MiniMax · Hugging Face · 14.8.2026

Musiikkimalli kutistui puoleentoista gigatavuun — MiniMax-Music3 sai eilen kuusi GGUF-kvantisointia

Avoimen painon musiikkigeneraattori julkaistiin viikko sitten Apache 2.0 -lisenssillä diffusers-muodossa. Eilen aamupäivällä ilmestyi GGUF-sarja: täysi F16 on 4,98 gigatavua, Q4_K_M 1,49 ja pienin Q3_K_M 1,16.

Lue juttu →

Sama kenttä, kaksi täyttötapaaProosamalli arvaa muodonKutsuesimerkkihaku(kysely="Helsinki", maara=3)Vaihda vain kysely.Pidä maara ennallaan.Muoto näytetään, ei selitetätoimii parhaiten 1–8 miljardin parametrin malleilla

Päivän promptivinkki

Älä kuvaile työkalua pienelle mallille — näytä sille valmis kutsu ja sano, mitä siitä muutetaan

Työkalun kuvauskenttä on paikka, johon kirjoitetaan proosaa. Pieni malli lukee sen huonosti. Sama kenttä täytettynä yhdellä konkreettisella esimerkkikutsulla ja yhdellä muutosohjeella tuottaa kelvollisia kutsuja huomattavasti useammin.

Lue juttu →

Monta muotoa · yksi esitysPDFDOCXEPUBEMLMP4WAVDoclingDocument2.120.1 · 14.8.MarkdownJSONDocTagsMIT · Linux Foundation AI & Data · paikallinen ajo

Päivän Python-kirjasto

docling 2.120.1: kirjasto, joka kääntää PDF:n, sähköpostin ja nyt myös videon samaan muotoon — kokonaan omalla koneella

Paikallisen haun vaikein osa ei ole malli vaan se, mitä mallille syötetään. Docling jäsentää PDF:t, Office-tiedostot, sähköpostit, EPUBit ja äänitiedostot yhteen esitysmuotoon. Uusin versio 2.120.1 ilmestyi eilen kello 11.51.

Lue juttu →

Kaista vastaan muistin määräMS-02 Ultra76,8 GB/s32 GB33,2 dB · 1 899 €Algoritmi 13AtomMan G1 Pro448 GB/s8 GB40 dB · 1 699 €Algoritmi 13Iltakoosteen valinta pitää lukemansa: 135

Mini-PC-vertailu · 1 000–2 000 €

Kuusi kertaa leveämpi väylä kahdeksassa gigatavussa vastaan kolmekymmentäkaksi gigatavua kapealla väylällä — ja indeksi antaa molemmille saman luvun

Minisforumin MS-02 Ultra maksaa 1 899 euroa ja lukee muistia 76,8 gigatavua sekunnissa kolmestakymmenestäkahdesta gigatavusta. Saman talon AtomMan G1 Pro maksaa 1 699 ja lukee 448 gigatavua sekunnissa kahdeksasta. Algoritmi antaa 12,96 ja 13,18. Kolmatta tietä ei tässä hintaluokassa juuri ole.

Lue juttu →

Kokeilemisen arvoista

Aja illan agenttirunko ilman asennusta, tarkista onko odotettu kirjastoversio jo olemassa, ja asenna työkalu, joka vie mallin NPU:lle

Kolme komentoa tästä vuorokaudesta. Ensimmäinen käynnistää DeepSeekin eilen avaaman agenttirungon suoraan npm-rekisteristä ilman pysyvää asennusta. Toinen vastaa illan Mallit-jutun kysymykseen yhdellä rivillä: onko transformers 5.16.0 jo ulkona vai ei. Kolmas asentaa eilen aamuyöllä julkaistun työkalun, jolla NPU-mallin saa FastFlowLM-rekisteriin.

npx @deepseek-ai/dsh web
curl -s https://pypi.org/pypi/transformers/json | python3 -c "import sys,json;print(json.load(sys.stdin)['info']['version'])"
uv tool install flm-add

Ensimmäinen komento noutaa ja käynnistää DeepSeek Harnessin selainkäyttöliittymän. Kyseessä on kehittäjien esiversio, ja DeepSeek varoittaa itse rikkovista muutoksista — npx on siksi järkevämpi kuin globaali asennus. Malliyhteyden voi osoittaa mihin tahansa OpenAI-yhteensopivaan päätepisteeseen, eli myös omaan llama-serveriin. Toinen komento kysyy PyPI:n rajapinnalta transformersin uusimman version numeron. Tätä kirjoitettaessa vastaus on 5.15.0, joka julkaistiin 10. elokuuta — ja se on koko illan Mallit-jutun ydin, koska Coheren uusi näkömalli vaatii version 5.16.0. Kun komento jonain päivänä palauttaa 5.16.0, mallin voi asentaa PyPI:stä eikä Gitistä. Kolmas komento asentaa flm-add-työkalun, joka rekisteröi valmiiksi käännetyn Q4NX-mallin FastFlowLM:lle. Se ei tee mitään ilman AMD:n XDNA2-NPU:ta ja XRT-pinoa, joten sen asentaminen muulle koneelle on harmitonta mutta hyödytöntä.