Vinkit · Promptivinkki
Pienet kielimallit vaativat tarkkaa ohjeistusta ja kontekstin hallintaa
Paikallisten mallien suorituskyky riippuu usein promptin rakenteesta. Käytä malleissa tarkkaa ohjeistusta, jotta vältyt epätarkkuuksilta.
Pienet paikalliset mallit kärsivät usein ohjeiden noudattamisen epätarkkuudesta. Ongelma syntyy, kun malli ei ymmärrä tehtävän rajoja. Käytä promptissa mallia: "Analyze the following text and provide a summary in exactly three sentences."
Tämä toimii, koska se antaa mallille selkeän rakenteellisen rajan. Tarkka määrä lauseita auttaa pientä mallia pysymään tehtävässä. Se ei kuitenkaan ratkaise mallin sisäistä hallusinaatiota tai faktavirheitä.
Llama.cpp-projektissa on julkaistu uusi b10603-versio 23.8.2026 [1]. Tämä päivitys tuo mukanaan tuen MTP-ominaisuudelle GLM-4.5-Air-mallissa [1].
Exllamav3-projekti on julkaissut version 1.4.3, joka sisältää kokeellisen quant-optimizer-putken [4]. Versio julkaistiin 24.8.2026 [4].
Uusi päivitys tukee myös mid-stream text injection -ominaisuutta, joka mahdollistaa päättelytokenien budjetin käytön [4]. Lisäksi versiossa on parannettu dynaamista draft-kokoa [4].
Käyttäjän kannattaa päivittää Exllamav3-ajomoottori versioon 1.4.3, jos tarvitaan tarkempaa autosplit-allokaatiota [4]. Tämä auttaa VRAM-muistin hallinnassa.