The latest llama.cpp release introduces a new CLAMP operation for Hexagon DSPs, enhancing its computational capabilities. This update also expands build support to include various platforms and hardware backends, such as CUDA 12 and 13 for Windows, ROCm 7.2 for Ubuntu x64, and KleidiAI for macOS Apple Silicon.
llama.cpp continues to broaden its hardware compatibility and optimize for diverse compute environments, making local LLM inference more accessible and efficient across different devices.