24.8 token每秒,3060级别12G显卡跑Qwen3.5-35B-A3B, Q4_K_M量化GGUF版,禁用思考模式,编译llama.cpp后4倍提速。

UP主:
封面:
简介: