实测 7.2GB 的 27B 大模型(Bonsai 2 PQ2_0)做代码 Agent 频频超时的收敛调优实战。通过...
Benchmark
开源本地大模型标准评测工具 LLST 发布。通过 102 道锁定样本、Docker 沙箱代码验证与确定性长上下文压力测试,测出本地模型的真实能力与 TTFT 首字延迟。首发包含双 RX...
分享 AI 工具实测、工作流搭建与内容增长复盘