Työkalut · llama.cpp
llama.cpp b10330 tuo CUDA-optimointeja ja muistivarmistuksia useille alustoille
Uusi b10330-versio julkaistiin 8.8.2026 kello 17.20 UTC [1]. Päivitys sisältää useita CUDA-ytimien yhdistelmiä [1].
llama.cpp-projektin b10330-versio on julkaistu 8.8.2026 kello 17.20 UTC [1]. Päivitys sisältää uusia CUDA-optimointeja, kuten rms_norm, mul, rope, view ja set_rows -ytimien yhdistelmiä [1].
Uusi versio tuo mukaan myös muistialueiden tarkistukset rms_norm rope fusion -toiminnossa sekä rope set_rows fusion -toiminnossa [1]. Testaukseen on lisätty broadcast weight -tapaus rms_norm_mul_rope-toiminnolle [1].
Päivitys on julkaistu GitHub Actionsin kautta [1]. Versio b10330 on merkitty vahvistetuksi GitHubin allekirjoituksella [1].
Tuetut alustat kattavat laajan kirjon, kuten Ubuntu x64 (CPU), Ubuntu arm64 (CPU) ja Windows x64 (CUDA 12) [1]. Myös macOS Apple Silicon (arm64) ja iOS XCFramework ovat tuettuja [1].
Windows-käyttäjille on tarjolla sekä CUDA 12.4 DLL-tiedostot että CUDA 13 -tuki [1]. Android-alustalle on saatavilla arm64 (CPU) -versio [1].
Käyttäjien, jotka hyödyntävät CUDA-kiihdytystä Windows-ympäristössä, kannattaa tarkistaa uusi versio [1]. Päivitys on suositeltava erityisesti niille, jotka tarvitsevat uusia muistivarmistuksia ja optimoituja ytimiä [1].