Ollama Releases· dhiltgen·AI 评分15
Ollama v0.34.4-rc0:MLX 加速 Qwen 3.8 提示词处理
v0.34.4-rc0: mlx: speed up Qwen 3.8 prompt processing (#18550)
AI 导读
Ollama 发布 v0.34.4-rc0,通过 MLX 加速 Qwen 3.8 的提示词处理。该版本对长扫描使用 MLX 的 gated-delta kernel,并将稠密 MLP 的全局缩放折叠进 SwiGLU。
来源:Ollama Releases · github.com