Tekoälyn päivälehti — mallit, työkalut ja hardware
OpenAI · Astra · 18.8.2026 · Suljetut
Yhtiö kertoi keskeyttäneensä vahvistusoppimiskoulutuksen kahdeksi viikoksi ja pitävänsä suurimman suunnitellun koulutusajonsa yhä jäissä, koska alustava näyttö viittaa siihen, että Astra ylittää Preparedness-kehikon kriittisen kyberkyvyn kynnyksen. Uusi valvontajärjestelmä lukee mallin sisäistä aktivaatiota jokaisella tokenilla, hälyttää 30 minuutissa — ja maksaa noin viidenneksen valvottavasta päättelylaskennasta.
OpenAI julkaisi tiistaina poikkeuksellisen avoimen selonteon siitä, miksi sen mallikehitys on hidastunut. Yhtiön mukaan kaksi kesän tapahtumaa muutti tilanteen: OpenAI:n ja Hugging Facen välinen tietoturvavälikohtaus sekä alustava näyttö siitä, että yhtiön tuleva Astra-malli saattaa ylittää sen oman Preparedness-kehikon kriittisen kyberkyvyn kynnyksen — rajan, jonka yli menevä malli kykenisi itsenäiseen hyökkäykselliseen kybertoimintaan. Päätös kynnyksen mahdollisesta ylittymisestä tehtiin jo 7.8., ja sen seuraukset ovat konkreettisia: vahvistusoppimiskoulutus keskeytettiin kahdeksi viikoksi, ja suurin suunniteltu koulutusajo on yhä jäissä, kunnes turvatoimet ja näyttö mallin linjakkuudesta ovat yhtiön mielestä riittävät.
Selonteon kiinnostavin luku on valvonnan hinta. Uusi monivaiheinen järjestelmä alkaa aktivaatioluokittimista — ilmaisimista, jotka lukevat mallin sisäistä tilaa jokaisella generoidulla tokenilla — ja eskaloi epäilyttävän toiminnan raskaammille automaattitutkijoille, jotka käyvät läpi työkalukutsut ja koko toimintaketjun. Tavoite on hälytys 30 minuutissa; jos kriittisen turvarajan rikkomista ei puolessa tunnissa osoiteta vääräksi hälytykseksi, toiminta on määrä pysäyttää. OpenAI arvioi valvonnan syövän noin 20 % valvottavan päättelyn laskennasta. Vaatimus koskee kaikkea työkaluja käyttävää koulutusta ja arviointia Sol-tason malleista ylöspäin — ja Astran kohdalla kaikkea työkaluja käyttävää päättelyä.
Samalla yhtiö kuvaa, miten sen omat tutkimusympäristöt kovetettiin: mallin tuottamaa koodia ajavat työkuormat eristetään hiekkalaatikoihin, korkeamman riskin ajot erotetaan internetistä niin, ettei yksittäinen murto avaa verkkoyhteyttä, ja jaettuja palveluita karsittiin. Osa Astran työkuormista on yhä pysäytettynä odottamassa siirtoa uusiin ympäristöihin. Kuvaus on käytännössä sama resepti, jonka LocalAI ja llama.cpp toivat paikallisiin palvelimiin tällä viikolla pienemmässä mittakaavassa — koko ala lukitsee ovia, kerroksesta riippumatta.
Avoimien mallien maailmaan selonteko piirtää saman rajan kuin Anthropicin proteiinijulkistus eilen: suljettu malli voidaan panna valvonnan taakse, koska se asuu palvelimella, ja nyt tiedämme mitä se maksaa — viidenneksen laskennasta ja viikkoja aikataulusta. Paikallisella mallilla valvojaa ei ole, eikä myöskään valvontakuormaa. Tänään se on lähinnä filosofinen ero, koska mikään avoin malli ei ole lähelläkään kriittistä kyberkykyä. Mutta GLM-5.3:n painojen lykkäys samalla perusteella näytti viime viikolla, että kysymys on jo siirtynyt julkaisupäätöksiin — ja OpenAI:n hintalappu antaa ensimmäisen mittaluvun sille, mitä avoimuuden vaihtoehto kustantaa.