重点
llama.cpp 修复 Vulkan 闪存注意力中的陈旧内存复用问题
llama.cpp b11414 版本修复了 Vulkan 后端在闪存注意力和 softmax 操作中陈旧预分配内存复用的关键错误。
编
潜龙编辑部
发布于 · 2026/10/05 13:08
illustration · QianLong editorial
核心摘要
llama.cpp b11414 版本修复了 Vulkan 后端在闪存注意力和 softmax 操作中陈旧预分配内存复用的关键错误。
机会与影响
此修复提高了 llama.cpp 在 Vulkan 上运行时的稳定性和潜在性能,对 macOS/iOS 用户尤其有利。
来源信息
该条资讯来自 github.com。标签:重点。相关平台:github。
潛