
OpenAI 直播活動
OpenAI 將舉辦一場直播活動。在直播期間將揭露具體的公告、產品發布或示範內容。
上一次 OpenAI 突然搞直播,他們直接丟出 GPT-4 Turbo,然後一夜之間改掉所有定價

有人拿 Qwen3.6 做了個實驗,用三種不同的量化方法(llama.cpp、ik_llama.cpp 和 Turboquant)在雙 GPU 上跑(3080 + 3060 各 12GB),其他設定完全一樣,只改量化方式。結果呢?Turboquant 直接掛掉,另外兩個方法卻跑得好好的。他用的是 TheTom/llama-cpp-turboquant 這個實作,除了量化參數(turbo3 vs q8_0)以外全部保持一致。如果你也想在家裡用有限的顯卡記憶體跑 Qwen3.6,這就是個警訊——Turboquant 可能還不夠穩定。