Paikallisen tekoälyn päivälehti — avoimen painon mallit, työkalut ja rauta

Maanantai 24. elokuuta 2026Aamupainos · klo 7Nro 17

← Takaisin numeroon 17

Vinkit · Promptivinkki

Pienet kielimallit vaativat tarkkaa ohjeistusta ja kontekstin hallintaa

Paikallisten mallien suorituskyky riippuu usein promptin rakenteesta. Käytä malleissa tarkkaa ohjeistusta, jotta vältyt epätarkkuuksilta.

Pienet kielimallit vaativat tarkkaa ohjeistusta ja kontekstin hallintaa Exllamav3 versio 1.4 versio Llama.cpp ja Exllamav3 päivitykset

Pienet paikalliset mallit kärsivät usein ohjeiden noudattamisen epätarkkuudesta. Ongelma syntyy, kun malli ei ymmärrä tehtävän rajoja. Käytä promptissa mallia: "Analyze the following text and provide a summary in exactly three sentences."

Tämä toimii, koska se antaa mallille selkeän rakenteellisen rajan. Tarkka määrä lauseita auttaa pientä mallia pysymään tehtävässä. Se ei kuitenkaan ratkaise mallin sisäistä hallusinaatiota tai faktavirheitä.

Llama.cpp-projektissa on julkaistu uusi b10603-versio 23.8.2026 [1]. Tämä päivitys tuo mukanaan tuen MTP-ominaisuudelle GLM-4.5-Air-mallissa [1].

Exllamav3-projekti on julkaissut version 1.4.3, joka sisältää kokeellisen quant-optimizer-putken [4]. Versio julkaistiin 24.8.2026 [4].

Uusi päivitys tukee myös mid-stream text injection -ominaisuutta, joka mahdollistaa päättelytokenien budjetin käytön [4]. Lisäksi versiossa on parannettu dynaamista draft-kokoa [4].

Käyttäjän kannattaa päivittää Exllamav3-ajomoottori versioon 1.4.3, jos tarvitaan tarkempaa autosplit-allokaatiota [4]. Tämä auttaa VRAM-muistin hallinnassa.

Lähteet