跳到正文
热点事件持续更新

llama.cpp b11310 修复 CUDA IQ4_NL 反量化越界

1 篇报道1 个报道来源23 小时前更新

先了解这件事

AI 综述

2026-10-01,llama.cpp 发布 b11310,修复 CUDA 后端 iq4_nl 反量化行 kernel 在短行上的越界读写问题。据该版本说明,dequantize_block_iq4_nl 每块写入 QK_K 个值,但 IQ4_NL 行只保证是 QK4_NL 的倍数,导致起始位置超出行长度的 32 值子块线程会读写越界;修复方式为跳过这些子块。

AI 根据报道生成 · 11 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. llama.cpp Releases
    llama.cpp b11310 修复 CUDA iq4_nl 反量化短行越界问题

    llama.cpp 发布 b11310,修复 CUDA 后端 iq4_nl 反量化行 kernel 在短行上的越界读写问题。dequantize_block_iq4_nl 每块写入 QK_K 个值,但 IQ4_NL 行只保证是 QK4_NL 的倍数,起始位置超出行长度的 32 值子块线程会读写越界,现改为跳过这些子块。

本事件热度走势

当前热度 5·可比范围峰值 7(10月1日 22:00)·近 24 小时可比范围变化 –

0246810月1日22:0010月2日02:0010月2日05:0010月2日09:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。