
OpenAI 直播活動
OpenAI 將舉辦一場直播活動。在直播期間將揭露具體的公告、產品發布或示範內容。
上一次 OpenAI 突然搞直播,他們直接丟出 GPT-4 Turbo,然後一夜之間改掉所有定價

這個月 Cursor 和 Zai 的訂閱額度都用爆了,我決定自己架設本地大型語言模型(LLM)。用 RTX 5090 跑 Qwen3.5 27B 的效果出乎意料地好,達到了相當不錯的每秒推論次數(tps)。內容視窗(context window)設定在 218k,甚至還能同時跑 2 個對話,雖然單個對話的速度會下降。有點奇怪的是我在 vLLM 0.19 版本上沒辦法用滿整個 256k 的內容視窗,在 0.17 版本可以跑但速度會變慢,因為 0.17 沒有新版本的那些優化功能。