llama.cpp Releases· github-actions[bot]·· 3 小时前AI 评分12
llama.cpp b11517 发布:CUDA 后端向 host MMQ 配置辅助函数传递 src1 精度
b11517
AI 导读
llama.cpp 发布 b11517,CUDA 后端在 host MMQ 配置辅助函数中显式传递 src1 精度。该改动由 NVIDIA 的 ynankani 提交,涉及 #30168。版本继续提供 CUDA 12.8、CUDA 13.4、ROCm 10.0、Vulkan、SYCL、OpenVINO 等多平台构建。
来源:llama.cpp Releases · github.com