Tekoälyn päivälehti — mallit, työkalut ja hardware
LLM-jp-4 33B · Apache 2.0 · 18.8.2026 · Mallit
Tokion LLM-tutkimuskeskus LLMC julkisti LLM-jp-4:n suurimman koon: tiheä 33,2 miljardin parametrin malli Apache 2.0 -lisenssillä, kahtena versiona ja DPO-koulutusaineistoineen. Thinking-versio päihittää keskuksen kaikki aiemmat mallit neljässä testissä.
Japanin kansallinen LLM-tutkimuskeskus LLMC, joka toimii kansallisen informatiikan instituutin NII:n alaisuudessa, julkisti tiistaina LLM-jp-4-perheen suurimman jäsenen: tiheän 33,2 miljardin parametrin kielimallin. Julkaisussa on kaksi versiota — pohjamalli llm-jp-4-33b-base ja jatkokoulutettu llm-jp-4-33b-thinking, joka on viritetty ohjeenseurantaan ja päättelyyn SFT- ja DPO-vaiheilla. Molemmat ovat Hugging Facessa Apache 2.0 -lisenssillä, ja painojen rinnalla keskus avasi myös DPO-vaiheen koulutusaineiston.
Thinking-versio on keskuksen omissa mittauksissa sen tähänastisista malleista paras kaikissa neljässä käytetyssä testissä: japanin- ja englanninkielisessä MT-Benchissä, turvallisuutta mittaavassa AnswerCarefully-testissä ja keskuksen omassa ohjeenseurantatestissä. Vertailu kohdistuu aiempiin LLM-jp-malleihin, ei kiinalaisiin tai yhdysvaltalaisiin kärkimalleihin — ja se on julkaisun pointti: kyse on läpinäkyvästä, kotimaisin voimin koulutetusta perusmallista, jonka koko putki on tutkijoiden tarkasteltavissa.
Uutinen jatkaa kesän eurooppalaisista numeroista tuttua kansallismallien sarjaa: Norja koulutti Borealiksen sanomalehtiaineistolla ja Liettua ajoi oman mallinsa nollasta. Japanin versio on näistä selvästi suurin ja resursoiduin, ja se kytkeytyy maan laajempaan strategiaan pitää kielimalliosaaminen kotimaassa. Paikallisajajalle 33 miljardin tiheä malli on työasemakokoa: nelibittisenä painot vievät laskennallisesti noin 20 gigatavua, eli malli mahtuu 24 gigatavun näytönohjaimeen tai 32 gigatavun yhteismuistikoneeseen. GGUF-käännöksiä ei julkaisuhetkellä vielä ollut, joten llama.cpp-käyttäjä joutuu joko kääntämään itse tai odottamaan yhteisön paketteja.
Ajankohta ei ole sattumaa. Hugging Facen tuore avointen mallien raportti kertoi, että kiinalaiset mallit hallitsevat latauksia ja johdannaisia, ja PC Watch laski maanantaina Qwen-johdannaisia olevan jo yli 150 000. Japanin vastaus ei kilpaile määrällä vaan omistajuudella: kun painot, koulutusreseptit ja datan valintaperusteet ovat julkisia, mallin voi ottaa viranomais- ja yrityskäyttöön ilman, että kukaan joutuu arvailemaan mitä sen sisällä on. Se on sama peruste, jolla eurooppalaiset kansallismallit perustelevat olemassaolonsa — nyt vain kymmenen kertaa suuremmassa koossa kuin useimmat niistä.