Qwen

Qwen3.8 27B 12GB 跑得動嗎?RTX 3060 搭 llama.cpp 的實測參數

Qwen3.8 27B 12GB 能不能跑,是手上只有 12GB 顯卡的人最先想知道的事。我們用 RTX 3060 搭 llama.cpp 實測兩天,整理量化檔選擇、llama-server 啟動參數、首次請求顯存不足的修法,以及 64K 上下文、生成速度、取樣參數與思考深度在慢硬體上的時間取捨。