Media · Puheentunnistus
Whisper-tiny-es-mix-norm on julkaistu Apache-2.0-lisenssillä ja se on optimoitu puheentunnistukseen
Uusi malli on julkaistu 16. elokuuta 2026. Sen latausmäärä on tähän mennessä 8237 kertaa [1].
Deepdml on julkaissut whisper-tiny-es-mix-norm -mallin, joka on tarkoitettu automaattiseen puheentunnistukseen [1]. Malli perustuu OpenAI:n whisper-tiny-pohjamalliin [1].
Malli on julkaistu 16.8.2026 ja se käyttää Apache-2.0-lisenssiä [1]. Sen latausmäärä on 8237 kertaa [1].
Tämä malli on hienosäädetty useilla eri aineistoilla, kuten common_voice_26_0 ja voxpopuli [1]. Käytettyjen aineistojen joukossa on myös basque_parliament ja google/fleurs [1].
Lisäksi hienosäätöön on hyödynnetty dataset:deepdml/voxforge ja dataset:facebook/multilingual_librispeech [1]. Aineistona on käytetty myös dataset:deepdml/common_voice_26_0 [1].
Rautavaatimuksia ei ole määritelty lähteessä, mutta malli perustuu whisper-tiny-arkkitehtuuriin [1]. Lisenssi on Apache-2.0 [1].
Lukijan kannattaa testata mallia paikallisesti, jos tarvitaan kevyttä puheentunnistusta espanjan kielellä [1].