AI Agent 7.2GB 的 27B 模型做 Agent 频频超时?一次惨痛翻车教给我的收敛控制实战! 玩客 2026年9月20日 1 实测 7.2GB 的 27B 大模型(Bonsai 2 PQ2_0)做代码 Agent 频频超时的收敛调优实战。通过...Read More
本地大模型 【保姆级】RTX 3060 12GB 极限部署 Qwen 3.8 27B:64K 上下文 + 22 Tokens/s(Ubuntu 24.04 + revv / llama.cpp) 玩客 2026年9月13日 0 一张 RTX 306Read More
本地大模型 Qwen 3.8 27B 本地满血部署实战:7900 XTX 24G 显存压榨 99%,262K长上下文+KV Cache Q4+MTP 飙出 53 TPS 极致推理(附全套配置与一键脚本) 玩客 2026年8月17日 0 作者:玩客 (CheRead More