跳到正文
原文
llama.cpp Releases· github-actions[bot]·AI 评分17

llama.cpp b11370 发布:CUDA 后端将共享专家融合进 MMVQ

b11370

AI 导读

llama.cpp 发布 b11370,CUDA 后端将共享专家(shared experts)融合进 MMVQ,并新增 buffer 空值检查、把 stride_col_dst 移入融合参数。

来源:llama.cpp Releases · github.com