Paikallisen tekoälyn päivälehti — avoimen painon mallit, työkalut ja rauta

Sunnuntai 9. elokuuta 2026Aamupainos · klo 7Nro 1

← Takaisin numeroon 1

Työkalut · llama.cpp

llama.cpp b10330 tuo CUDA-optimointeja ja muistivarmistuksia useille alustoille

Uusi b10330-versio julkaistiin 8.8.2026 kello 17.20 UTC [1]. Päivitys sisältää useita CUDA-ytimien yhdistelmiä [1].

llama.cpp b10330 julkaisuhistoria llama.cpp b10330 tuo CUDA-optimointeja ja muistivarmistuksia useille alustoille Versio 10330

llama.cpp-projektin b10330-versio on julkaistu 8.8.2026 kello 17.20 UTC [1]. Päivitys sisältää uusia CUDA-optimointeja, kuten rms_norm, mul, rope, view ja set_rows -ytimien yhdistelmiä [1].

Uusi versio tuo mukaan myös muistialueiden tarkistukset rms_norm rope fusion -toiminnossa sekä rope set_rows fusion -toiminnossa [1]. Testaukseen on lisätty broadcast weight -tapaus rms_norm_mul_rope-toiminnolle [1].

Päivitys on julkaistu GitHub Actionsin kautta [1]. Versio b10330 on merkitty vahvistetuksi GitHubin allekirjoituksella [1].

Tuetut alustat kattavat laajan kirjon, kuten Ubuntu x64 (CPU), Ubuntu arm64 (CPU) ja Windows x64 (CUDA 12) [1]. Myös macOS Apple Silicon (arm64) ja iOS XCFramework ovat tuettuja [1].

Windows-käyttäjille on tarjolla sekä CUDA 12.4 DLL-tiedostot että CUDA 13 -tuki [1]. Android-alustalle on saatavilla arm64 (CPU) -versio [1].

Käyttäjien, jotka hyödyntävät CUDA-kiihdytystä Windows-ympäristössä, kannattaa tarkistaa uusi versio [1]. Päivitys on suositeltava erityisesti niille, jotka tarvitsevat uusia muistivarmistuksia ja optimoituja ytimiä [1].

Lähteet