
OpenAI 直播活動
OpenAI 將舉辦一場直播活動。在直播期間將揭露具體的公告、產品發布或示範內容。
上一次 OpenAI 突然搞直播,他們直接丟出 GPT-4 Turbo,然後一夜之間改掉所有定價

有人實測了 Nvidia 新的 NVFP4 壓縮技術在 Gemma-4-26B 上的表現,結果超扯:模型從原本的大小直接縮到只有 18.8GB,意思是它現在可以輕鬆跑在單張 RTX 5090 上,還有記憶體剩下。他們用 GPU 記憶體的 80% 就跑出了 5 萬 token 的上下文長度。基準測試呢?幾乎沒掉效能。AIME 甚至還進步了(88.95% → 90%),其他的也都在 0.2-0.7% 以內。這種壓縮技術通常會毀掉效能,但這次根本是天上掉下來的禮物——模型更小、智能沒少、還跑得更快。如果你一直在等高品質開源模型但又不想買整個資料中心,這次真的改變遊戲規則了。