Iltakooste

Tekoälyn päivälehti — mallit, työkalut ja hardware

Torstai · 13. elokuuta 2026Iltapainos · klo 21Nro 41

DeepSeek julkaisi tänään lippulaivansa avoimin painoin. DeepSeek-V4-Pro-0813 on MIT-lisenssillä jaettava sekoitusmalli, jonka FP8-painot vievät 892,8 gigatavua ja jonka sisään on koulutettu oma spekulatiivisen dekoodauksen moduuli nimeltä DSpark. Kotikoneelle se ei mahdu missään muodossa — mutta tämä ilta jää silti mieleen siitä, kuinka valmiina paikallinen työkaluketju jättiläistä odotti. Sillä juuri tänään llama.cpp yhdisti kolme spekulatiivisen dekoodauksen muutosta, joiden jälkeen luonnosmallin tyyppiä ei enää kerrota käsin — se luetaan GGUF-tiedoston metatiedoista, ja näytönohjaimella tapahtuva näytteenotto toimii myös DSpark- ja DFlash-luonnoksilla. vLLM ehti jo aiemmin samalle viikolle kahdella DSpark-julkaisulla, ja Unsloth julkisti työpöytäsovelluksensa virallisesti. Harvoin uusi mallijulkaisu on laskeutunut näin katettuun pöytään. Riippumaton mittaus ehti sekin samaan vuorokauteen: Artificial Analysis antaa uudelle Prolle pistemäärän 53 — täsmälleen yhden pisteen enemmän kuin talon omalle, monin verroin halvemmalle Flash-mallille. Japanilainen PC Watch puolestaan vahvistaa, että rajapinnan hinnat eivät julkaisussa muuttuneet. Raudan puolella uutiset ovat tylympiä: Nvidia korotti 96 gigatavun RTX Pro 6000:n hinnan 16 000 dollariin, ja korotuksia kertyy julkaisusta jo 88 prosenttia. Mini-PC-palstalla sen sijaan tapahtui jotain, mitä on odotettu kolme viikkoa: kalleimmasta hintaluokasta löytyi vihdoin mitattua melutietoa, ja vertailuun saatiin HP:n 64 gigatavun työasema ja ASUSin näytönohjainkone. Ja Linux-työpöydälle, paikallisen tekoälyn kotikentälle, saapui yllättävä vieras: ChatGPT.

1,57 biljoonaa parametria · MIT384 asiantuntijaa · 6 + 1 laskee tokenia kohti61 kerrosta · FP8 + FP4DSpark892,8 GB painojakonteksti 1 048 576 tokenia · ulostulo enintään 384 000

DeepSeek · Hugging Face · 13.8.2026

DeepSeek avasi lippulaivansa painot MIT-lisenssillä — ja rakensi spekulatiivisen dekoodauksen mallin sisään

DeepSeek-V4-Pro-0813 on virallinen julkaisu esikatseluversion tilalle: noin 1,57 biljoonaa parametria, joista 48 miljardia laskee, miljoonan tokenin konteksti ja FP8-painot, jotka vievät 892,8 gigatavua. Uutta on DSpark-moduuli, joka kulkee samassa checkpointissa — luonnosmallia ei ladata erikseen.

Lue pääjuttu →

Kolme vetoa, yksi päivä#26814 · luonnoksen tyyppi GGUF-metatiedoista#27005 · MTP-luonnos tunnistetaan itsestään#26958 · GPU-näytteenotto: DFlash + DSpark— samana päivänä kuin DSpark-lippulaivallama.cpp b10411

llama.cpp · b10399–b10411 · 13.8.2026

llama.cpp lakkasi kysymästä, millainen luonnosmalli sinulla on — se lukee vastauksen GGUF:n metatiedoista

Kolme spekulatiivisen dekoodauksen yhdistämistä samana päivänä: luonnosmallin tyyppi tunnistetaan nyt automaattisesti GGUF-metatiedoista, MTP-luonnokset tunnistetaan omana lajinaan, ja näytönohjaimella tapahtuva näytteenotto toimii myös DFlash- ja DSpark-luonnoksilla. Ajoitus ei jää epäselväksi kenellekään.

Lue juttu →

vLLM 0.27 -sarja0.27.010.8. · 561 committia0.27.1kvantisoidut päät0.27.2rc0itsesäätyvä varmistus13.8.: DeepSeek-V4-Pro-0813 + DSparkluonnos ja päämalli samassa checkpointissa

vLLM · 0.27.1 ja 0.27.2rc0 · 11.–12.8.2026

vLLM hioi DSparkia kaksi julkaisua peräkkäin — kvantisoidut luonnospäät ja varmistus, joka säätää itse itseään

Versio 0.27.1 toi tuen kvantisoiduille DSpark-luonnospäille, ja seuraavan version ensimmäinen kandidaatti rakentaa varmistuksen, joka aikatauluttaa itsensä luonnoksen varmuuden mukaan. Kaksi päivää myöhemmin DeepSeek julkaisi mallin, jossa DSpark on vakiovaruste.

Lue juttu →

Aja ja kouluta — sama sovellusajaGGUF · MLXkoulutaLoRA · vientiWindows · macOS · Linux0.1.702-beta: +10 % nopeutta, säädettävä VRAM

Unsloth · Desktop 0.1.702-beta · 13.8.2026

Unsloth Desktop julkistettiin virallisesti — ja sai samana päivänä päivityksen, joka kertoo mihin suuntaan sovellus kasvaa

Unsloth kutsuu sovellustaan ensimmäiseksi työpöytäohjelmaksi, joka sekä ajaa että kouluttaa malleja paikallisesti Windowsilla, Macilla ja Linuxilla. Saman päivän 0.1.702-beta toi työkalukutsut ulkoisille palveluntarjoajille, säädettävän muistinkäytön ja paremman AMD-tuen.

Lue juttu →

repeat_penalty: oletus vaihtui1,1ennen · rangaistus päällä1,0nyt · pois päältä+ NVFP4-esitäyttö: qwen3.6:27b 703 → 769 t/s (M5 Max)+ blob-varmistuksen korjausOllama v0.32.10 · 12.8.2026

Ollama · v0.32.10 · 12.8.2026

Ollama sammutti toistorangaistuksen oletuksena — ja vanha malli saattaa nyt jäädä jankkaamaan

Mallit, jotka eivät itse aseta repeat_penalty-arvoa, saavat nyt arvon 1,0 eli rangaistus on pois päältä. Muutos yhdenmukaistaa Ollaman muiden moottoreiden kanssa ja nopeuttaa spekulatiivista dekoodausta — mutta se myös muuttaa hiljaa sitä, mitä koneesi kirjoittaa.

Lue juttu →

RTX Pro 6000 · 96 GB GDDR78 500 $13 250 $16 000 $kevät 2025kesäkuu 2026elokuu 2026

Laitteisto · ComputerBase · 13.8.2026

Nvidia korotti RTX Pro 6000:n hintaa taas — 16 000 dollaria on 88 prosenttia enemmän kuin julkaisussa

Vahvimman Blackwell-työasemakortin hinta nousi Nvidian omassa kaupassa 13 250 dollarista 16 000:een. Kortin 96 gigatavua GDDR7:ää on suorin tie ulos paikallisajon muistirajoista — ja juuri siksi sen hinta seuraa nyt muistimarkkinaa, ei näytönohjainmarkkinaa.

Lue juttu →

Kymmenen testin yhdistelmäV4 Flash 0731GLM-5.2V4 Pro 0813GPT-5.6 Terra52535357Artificial Analysis Intelligence Index v4.1.1 · max-päättelytaso

Benchmarkit · Artificial Analysis · 13.8.2026

Riippumaton mittaus antoi uudelle Prolle 53 pistettä — tasan yhden enemmän kuin talon omalle halpamallille

Artificial Analysis ehti mitata DeepSeek-V4-Pro-0813:n julkaisupäivänä: 53 pistettä kymmenen testin yhdistelmässä, piste enemmän kuin Flash-0731 ja neljä vähemmän kuin GPT-5.6:n keskikokoinen Terra. South China Morning Post tiivisti saman havainnon: yleistesteissä vaisu, kyberturvassa vahva.

Lue juttu →

Kolme alustaa, yksi vuorokausiSYCL5vetoa päivässäIntel Arc · oneAPIMetalTQ2_0ternäärikvantitApple siliconHIP−unsafemath-lippu poisAMD ROCmllama.cpp master · 13.8.2026

Alustat · llama.cpp · 13.8.2026

Intelin taustaosa sai viisi vetoa yhdessä päivässä — ja Apple sai ternäärikvantit, AMD menetti vaarallisen matematiikan

llama.cpp:n keskiviikko ja torstai olivat alustapäiviä: SYCL-taustaosaan laskeutui viisi parannusta kiinnitetystä isäntämuistista fuusio-operaatioihin, Metal oppi TQ2_0-ternäärikvantit, ja HIP-käännöksestä poistettiin unsafe-math-lippu. Kolme alustaa, sama viesti: reunoja hiotaan tosissaan.

Lue juttu →

Uusi vieras kotikentällä$ sudo apt install chatgptubuntu 24.04 / 26.04 · debian 13fedora 43 / 44 · x64 + arm64codex · selain · ääniesikatselu · DEB- ja RPM-paketit · 11.8.2026

Suljetut · OpenAI · 11.8.2026

ChatGPT tuli Linux-työpöydälle — suljettu malli muutti paikallisen tekoälyn kotikentälle

OpenAI julkaisi ChatGPT:n virallisen työpöytäsovelluksen Linuxille esikatseluna: Ubuntu, Debian ja Fedora, x64 ja ARM64, DEB- ja RPM-paketit. Mukana tulevat Codex, sisäänrakennettu selain ja äänikäyttö. Kuukausi sitten saman teki Anthropic — Linux-pöytäkone ei ole enää pelkkien avointen mallien maata.

Lue juttu →

Yksi ääninäyte · viisi kieltäzh · en · ja · es · artunne: 8 säädintä, erillään sävystänopeus: 0,5×–2,0×~0,8 mrd parametria · ~6 GB VRAMGPT-runko + flow matching + BigVGAN · 22,05 kHz

Media · Bilibili IndexTeam · 10.–12.8.2026

Bilibilin IndexTTS-2.5 kloonaa äänen yhdestä näytteestä viidellä kielellä — ja tunne säädetään erillään äänenväristä

Videopalvelu Bilibilin puhesynteesimalli laajeni japaniin, espanjaan ja arabiaan, sai puhenopeuden säädön ja nopeutui. GPT-runko on noin 0,8 miljardia parametria ja päättely vaatii noin 6 gigatavua näyttömuistia. Lisenssi on Bilibilin oma — ei avoin sana varsinaisessa merkityksessä.

Lue juttu →

Vastaus päättyy, kun merkki tuleeVastaus tähän. Päätä riville: ###VALMIS###VALMISkatkaisusama merkkijono kehotteessa ja moottorin stop-asetuksessa

Päivän promptivinkki

Älä luota siihen, että pieni malli osaa lopettaa — anna sille lopetusmerkki ja katkaise siihen

Pieni malli ei jankkaa siksi, että se olisi tyhmä, vaan siksi, ettei se tiedä milloin vastaus on valmis. Kun kehote käskee päättämään vastauksen sovittuun merkkijonoon ja ajomoottori katkaisee generoinnin samaan merkkijonoon, jankkaus loppuu kuin seinään.

Lue juttu →

pydantic-ai 2.29.0class Tulos(BaseModel)summa: intllama-server · OllamavLLM · LM StudioGHSA-h4xc-3qfq-jf93 · vakavaverkkosivu saattoi komentaa paikallista agenttiakorjattu: 2.28.0 (v2) · 1.107.4 (v1) · PyPI 13.8.2026

Päivän Python-kirjasto · pydantic-ai 2.29.0

pydantic-ai: tyypitetyt agentit paikalliselle mallille — ja korjaus, jonka takia päivitys ei ole makuasia

Pydanticin agenttikehys validoi mallin vastaukset tyypeiksi ja puhuu kaikille OpenAI-yhteensopiville paikallisille palvelimille. Tuoreessa versiossa on MCP-tuen laajennus — ja takana kaksi tietoturvakorjausta, joista vakavampi antoi minkä tahansa verkkosivun komentaa kehityskoneen agenttia.

Lue juttu →

Muistin määrä vastaan muistin nopeusHP Z2 Mini G1a3 748 €64 GB · 273 GB/s · 28 dBASUS ROG NUC 20255 300 €16 GB VRAM · 768 GB/s · 35 dB31 miljardin malli: HP ajaa · ASUS ei aja12 miljardin malli: ASUS ~75 t/s · HP ~27 t/skalleimman luokan ensimmäinen mitattu pari

Mini-PC-vertailu · vuorossa oleva luokka: yli 3000 €

HP Z2 Mini G1a vastaan ASUS ROG NUC 2025 — työaseman 64 gigatavua kohtasi pelikoneen salamakortin

Kalleimmasta luokasta löytyi vihdoin kaksi konetta, joiden lepomelu on mitattu. HP:n Strix Halo -työasema kantaa 64 gigatavua yhteismuistia, ASUSin pelikone 16 gigatavua GDDR7:ää lähes kolminkertaisella kaistalla. Toinen ajaa isot mallit, toinen ajaa pienet lujaa — ja valinta on harvinaisen selvä.

Lue juttu →

Kokeilemisen arvoista

Kurkista jättimallin GGUF-varastoon, hae illan spekulointibuildit ja asenna paikattu agenttikirjasto

Kolme komentoa tämän vuorokauden julkaisuista. Ensimmäinen ei lataa painoja vaan listaa, mitä Unslothin tuoreessa GGUF-varastossa jo on — varasto täyttyy paraikaa. Toinen hakee llama.cpp:n buildin, jossa on päivän kolme spekulatiivisen dekoodauksen yhdistämistä. Kolmas asentaa päivän Python-kirjaston versiona, jossa on kaksi tuoretta tietoturvakorjausta.

curl -s https://huggingface.co/api/models/unsloth/DeepSeek-V4-Pro-0813-GGUF | python3 -m json.tool | head -30
curl -LO https://github.com/ggml-org/llama.cpp/releases/download/b10411/llama-b10411-bin-ubuntu-x64.tar.gz
pip install "pydantic-ai==2.29.0"

Ensimmäinen komento kysyy Hugging Facen rajapinnalta Unslothin DeepSeek-V4-Pro-0813-GGUF-varaston tilan. Varaston kuvaus sanoo tänään suoraan "In progress will take a while" — kvantisoinnit ilmestyvät tiedosto kerrallaan, ja komennolla näkee mitä on jo tullut ennen kuin lataa mitään. Unslothin oman ohjeen mukaan malli on 1,57 biljoonan parametrin kokoluokkaa, joten pienimmätkin versiot tulevat olemaan satojen gigatavujen luokkaa. Toinen komento hakee buildin b10411, jossa ovat luonnosmallin tyypin automaattitunnistus ja DSpark/DFlash-luonnosten näytönohjainnäytteenotto sekä Metalin uusi ternäärikvanttituki. Kolmas asentaa pydantic-ai:n version 2.29.0; jos olet joskus käynnistänyt kirjaston kehityskäyttöliittymän komennolla clai web tai Agent.to_web(), päivitys kannattaa tehdä heti, koska vanhoissa versioissa mikä tahansa selaimessa auki oleva verkkosivu saattoi komentaa paikallista agenttiasi. Ykkösversion linjalla korjattu versio on 1.107.4.