跳到正文
llama.cpp Releases· github-actions[bot]·· 3 小时前AI 评分12

llama.cpp b11517 发布:CUDA 后端向 host MMQ 配置辅助函数传递 src1 精度

b11517

AI 导读

llama.cpp 发布 b11517,CUDA 后端在 host MMQ 配置辅助函数中显式传递 src1 精度。该改动由 NVIDIA 的 ynankani 提交,涉及 #30168。版本继续提供 CUDA 12.8、CUDA 13.4、ROCm 10.0、Vulkan、SYCL、OpenVINO 等多平台构建。

来源:llama.cpp Releases · github.com