往下拉回到首頁
Qwen3.6 不吃 Turboquant——量化方法大亂鬥

Qwen3.6 不吃 Turboquant——量化方法大亂鬥

Qwen3.6 Crashes When Using Turboquant—Here's What Happened

有人拿 Qwen3.6 做了個實驗,用三種不同的量化方法(llama.cpp、ik_llama.cpp 和 Turboquant)在雙 GPU 上跑(3080 + 3060 各 12GB),其他設定完全一樣,只改量化方式。結果呢?Turboquant 直接掛掉,另外兩個方法卻跑得好好的。他用的是 TheTom/llama-cpp-turboquant 這個實作,除了量化參數(turbo3 vs q8_0)以外全部保持一致。如果你也想在家裡用有限的顯卡記憶體跑 Qwen3.6,這就是個警訊——Turboquant 可能還不夠穩定。