llama.cpp Releases· github-actions[bot]·AI 评分20
llama.cpp b11351 为 ggml 缓冲区类型接口新增 alloc_buffer_n
b11351
AI 导读
llama.cpp 发布 b11351,为 ggml 后端缓冲区类型接口新增 alloc_buffer_n 方法及公开 API ggml_backend_buft_alloc_buffer_n,默认实现负责多缓冲区拆分与张量分配。Meta 缓冲区类型提供自定义实现,按设备创建子上下文并委托给简单缓冲区类型;同时新增 get_alloc_size_n 接口与相关测试覆盖。
来源:llama.cpp Releases · github.com