
OpenAI 直播活動
OpenAI 將舉辦一場直播活動。在直播期間將揭露具體的公告、產品發布或示範內容。
上一次 OpenAI 突然搞直播,他們直接丟出 GPT-4 Turbo,然後一夜之間改掉所有定價

感謝 jukofyork 和 AesSedai 今天提供的建議,讓我成功壓縮量化(quantize)了「完整版」Kimi-K2.6 的 Q4_X 模型。只要你有超過 584GB 的 RAM+VRAM,這個模型就能在 ik 和主線 llama.cpp 上運行。我稍後會分享 imatrix 的方法給其他想製作客製化量化版本的人,以及一些能在 ik_llama.cpp 上執行的較小量化版本。AesSedai 應該也會很快推出針對主線 MoE 最佳化的配方!期待看看這個大傢伙和 GLM-5.1 的表現比較。