llama.cpp Releases· github-actions[bot]·· 3 小时前AI 评分12
llama.cpp b11523 修复 WebGPU 后端 GGML_OP_DUP 支持
b11523
AI 导读
llama.cpp 发布 b11523,为 WebGPU 后端补上 GGML_OP_DUP 支持,修复了 PR-29622 混合批处理路径的崩溃问题。此前 DUP 在 CPU 上执行、set_rows 却调度到 WebGPU,导致绑定 CPU 缓冲区后崩溃;现在 DUP 与 CPY、CONT 走同一路径。
来源:llama.cpp Releases · github.com