Bumps ggml to 0.20.2
ggml releases version 0.20.2 with CUDA optimizations, UI refactoring, and server improvements.
[!NOTE] Semantic versioning is still work in progress. More info can be found in https://github.com/ggml-org/ggml/discussions/1579 Nightly build: b10485 Change log since v0.1.1 1511ce3bc sync : ggml da786dc23 ggml : bump version to 0.20.2 (ggml/1589) 27e345b57 build : fix xcframework + cmake clean-up (#27304) 8b8640097 ci : create pre-release with change log and nightly link in make-release (#27302) 25ae3a9b3 CUDA: MMVQ nwarps=8 for bs=1 for dense models on DGX Spark (#26843) 01818e495 ui: enforce alphabetical enum member ordering (#27272) 0021a77de ui: Refactor Built-In Tools naming (Server/Browser) (#27271) 058df671b ci: more optimizations (#26983) 087f94d82 doc: document MCP stdio servers and CORS defaults in the server README [no release] [no ci] (#26847) 533b18257 server: save processed mtmd chunks as placeholder (#27278) ed1c3a20f mtmd: use sha256 for input hashing (#27274) d8df12ebc vocab : support integer tokenizer scores (#27260) b75ecd197 mtmd : skip thumbnail for non-tiled LFM2 images (#27246) 60eeeb608 cuda : skip UMA override for HIP builds (#27083) 39be55c97 vendor: move hash to vendor (#27262)
- github.comllama.cpp v0.1.2primary