Tekoälyn päivälehti — mallit, työkalut ja hardware
Päivän promptivinkki · Vinkit
Pieni malli ei kysy tarkennusta. Se arvaa, mitä tarkoitit, ja rakentaa koko vastauksen arvauksen päälle. Yksi pakollinen rivi vastauksen alkuun tekee arvauksesta näkyvän — ja tekee siitä myös paremman.
Ongelma on tuttu jokaiselle, joka ajaa pientä mallia. Annat tehtävän, malli vastaa sujuvasti ja pitkästi, ja vasta kolmannessa kappaleessa huomaat, että se ymmärsi kysymyksen väärin. Iso malli kysyisi tarkennusta. Pieni malli ei kysy — sen jälkikoulutus palkitsee vastaamisesta, ei epäröinnistä. Se valitsee todennäköisimmän tulkinnan ja rakentaa koko vastauksen sen päälle.
Korjaus on yksi pakollinen rivi. Kehotteeseen kirjoitetaan sanatarkasti näin:
"Aloita vastauksesi aina rivillä, joka alkaa sanalla TEHTÄVÄ:. Kirjoita siihen omin sanoin, enintään 20 sanalla, mitä ymmärsit minun pyytäneen. Älä lainaa pyyntöäni sanasta sanaan vaan tiivistä se. Jätä sitten tyhjä rivi ja vastaa vasta sen jälkeen."
Miksi se toimii? Kahdesta syystä, ja vain toinen niistä on ilmeinen. Ilmeinen on se, että näet tulkinnan heti ensimmäiseltä riviltä ja voit keskeyttää ennen kuin malli tuottaa tuhat tokenia väärää vastausta. Vähemmän ilmeinen on se, että toistaminen omin sanoin parantaa itse vastausta. Kun malli kirjoittaa tehtävän uudelleen, se joutuu tekemään tulkintapäätöksen ääneen, ja tuo päätös on sen jälkeen kontekstissa — eli se ohjaa loppua vastausta. Ilman toistoriviä sama päätös tehdään implisiittisesti ja epäjohdonmukaisesti pitkin vastausta.
Kaksi yksityiskohtaa ratkaisee. Ensinnäkin sanatarkka kielto lainata pyyntöä: jos et kiellä, pieni malli kopioi kysymyksesi sellaisenaan, eikä kopio paljasta väärinymmärrystä lainkaan. Tiivistäminen omin sanoin on koko vinkin ydin. Toiseksi sanamäärän katto: ilman sitä toistorivi paisuu kappaleeksi ja alkaa jo vastata kysymykseen, jolloin menetät sekä lyhyyden että selkeän katkoskohdan.
Erityisen hyvin tämä toimii kolmessa tilanteessa: pitkissä tekstinkäsittelytehtävissä, joissa vastauksen tuottaminen kestää minuutteja; agenttitehtävissä, joissa väärä tulkinta johtaa työkalukutsuihin joita ei voi perua; ja monivaiheisissa keskusteluissa, joissa aiempi konteksti vetää mallia väärään suuntaan. Illan pääuutisen mallissa, jossa preserve_thinking on oletuksena päällä ja aiemmat päättelyketjut säilyvät, kolmas tapaus on erityisen ajankohtainen.
Mitä tämä ei ratkaise: se ei tee mallista tarkempaa faktoissa eikä paranna päättelyä. Väärin ymmärretty tehtävä on eri vika kuin väärin päätelty vastaus, ja tämä vinkki osuu vain ensimmäiseen. Se ei myöskään auta, jos oma pyyntösi on aidosti monitulkintainen — silloin toistorivi vain näyttää sinulle, että valinnanvaraa oli, ja korjaus kuuluu kehotteeseen eikä malliin. Ja jos ajat mallia putkessa ilman ihmistä lukemassa, muista poistaa toistorivi ohjelmallisesti ennen kuin vastaus menee eteenpäin.