小显存跑本地 coding agent,挑量化版本时很容易先看文件能不能塞进去。SharpSpark 是在 Spark-X2.5-4B 上做的第三方版本,改了量化,也修了聊天模板。模型卡给 4 GB 显存推荐 Q4,文件约 2.67 GB;6 GB 以上则建议选约 3.61 GB 的 Q6。
我更想先看它验证了哪一档。发布者拿 SWE-bench-Live 的 17 道题跑了 3 次,Q6 平均解出 5.7 道。Q4 虽然更容易装下,但不能把 Q6 的这组成绩直接算到它头上,作者也把 Q4 写成后备选择。
所以手里如果是小显存机器,可以照着档位先选一个能跑的版本,再用自己的代码仓库试。6 GB 显存也别只减去模型文件大小,长上下文还会占 KV 缓存。这组 17 题的自测,不能替你回答日常任务好不好用。
