GLM 协助:llama.cpp AMD GFX906 分支复活 GCN HIP 支持
一位开发者在 r/LocalLLaMA 发布了他用 GLM 协助创建的 llama.cpp 分支,目标是把 GFX906 系的 AMD 老卡重新带回推理场景。GFX906 对应 Vega 20 世代,覆盖 Radeon VII、MI50 与 MI60,都属于 GCN 5.1 架构。这套架构走的是 HIP 后端,而 ROCm 官方主线近年逐步收窄对 GCN 的支持,老卡想在当前 llama.cpp 上跑本地模型基本没有官方路径。 分支做的是把 HIP 内核按 GCN 特性重新适配,让这些被官方放弃的卡重新进入 llama.cpp 的推理流程。作者发帖的目的很直接——征求反馈,项目还处于早期阶段。Radeon VII 上的 16GB HBM2 显存在当时是消费级旗舰配置,这类卡在二手市场仍有一批保有量,恢复支持对预算受限的本地推理用户有实际意义。