Koodi · Python-kirjasto
TRL-kirjasto 1.10.0 tuo vakaan DistillationTrainer-ominaisuuden kielimallien jälkikoulutukseen
Versio 1.10.0 julkaistiin 13.8.2026. Kirjasto tarjoaa työkaluja transformer-pohjaisten kielimallien vahvistusoppimiseen [1].
TRL-kirjaston versio 1.10.0 on julkaistu 13.8.2026 [1]. Kirjasto on suunniteltu transformer-pohjaisten kielimallien vahvistusoppimiseen (reinforcement learning) [1].
Uusi päivitys tuo mukanaan vakaan DistillationTrainer-ominaisuuden [1]. Kyseessä on on-policy-pohjainen tiedon tislaamiseen (knowledge distillation) tarkoitettu rajapinta [1].
Kirjasto liittyy paikalliseen ajoon mahdollistamalla peruskoulutettujen mallien (foundation models) jälkikoulutuksen [1]. Tämä auttaa optimoimaan malleja paikalliseen käyttöön sopiviksi [1].
Taustalla toimii Hugging Face, joka on julkaissut kirjaston avoimella lisenssillä [1]. Kirjasto on osa laajempaa ekosysteemiä, joka tukee kielimallien hienosäätöä [1].
Kirjaston tuki ja dokumentaatio löytyvät Hugging Face Hubin kautta [1]. Käyttäjät voivat seurata kehitystä GitHub-alustalla [1].
Lukijan kannattaa hyödyntää DistillationTrainer-ominaisuutta, jos tavoitteena on tislailla tietoa suuremmista malleista pienemmille paikallisille malleille [1].