The latest llama.cpp release introduces OpenCL support for broadcast operations and view_offs handling for Adreno MUL_MAT and Q8_0 MUL_MAT, enhancing multi-stream performance on Qualcomm's mobile GPUs. This update also includes general GEMM/GEMV broadcast support and is available across various platforms including Windows arm64 with OpenCL Adreno.