跳到正文
原文
Ollama Releases· dhiltgen·AI 评分15

Ollama v0.34.4-rc0:MLX 加速 Qwen 3.8 提示词处理

v0.34.4-rc0: mlx: speed up Qwen 3.8 prompt processing (#18550)

AI 导读

Ollama 发布 v0.34.4-rc0,通过 MLX 加速 Qwen 3.8 的提示词处理。该版本对长扫描使用 MLX 的 gated-delta kernel,并将稠密 MLP 的全局缩放折叠进 SwiGLU。

来源:Ollama Releases · github.com