Releases llama.cpp b10726–b10729 Released — Performance Improvements for Metal, CUDA, and AVX2 and New Features
Releases llama-cpp b10724 Released — Significant Speedup in KV Cache Restoration, Improvements to Multiple Backends