Published on2026年7月24日Qwen3.6-27B 部署指南 - 256K 上下文下的最优配置AILLMllama.cppQwen3.6在 AMD RX 395 (96GB) 上使用 llama.cpp Vulkan 版部署 Qwen3.6-27B-UD-Q4_K_XL,开启 MTP 推测解码,256K 上下文实测 22 token/s 的最优配置
Published on2026年7月24日Ternary-Bonsai-27B 部署与调优指南AILLMllama.cppTernary-Bonsai在 AMD 395 (96GB 显存) 上使用 llama.cpp Prism 分支部署 Ternary-Bonsai-27B,开启 DSpark 推测解码的完整指南与参数调优
Published on2026年7月21日llama.cpp + Hy3 部署指南AILLMllama.cpp在 AMD 96GB 显存上使用 llama.cpp Vulkan 版部署 Hy3-IQ1_M-mtp.gguf 模型的完整指南