
OpenAI ライブストリーム
OpenAIがライブストリーム配信イベントを開催します。放送中に具体的な発表、新製品発表、またはデモンストレーションが明かされる予定です。
OpenAIが前回予告なしのライブストリームをやった時、GPT-4 Turboをドロップして、一晩で価格設定を完全に変えました

今月の Cursor と Zai のサブスクリプション額度を使い切ってしまったので、ローカルで大規模言語モデル(LLM)を構築することにしました。RTX 5090 で Qwen3.5 27B を実行したところ、予想外に良い結果が得られ、かなり良好な推論速度(tps)を達成できました。コンテキストウィンドウは 218k に設定でき、2 つの同時セッションも実行可能ですが、セッションごとの速度は低下します。vLLM 0.19 では 256k のフルコンテキストウィンドウで動作させられませんでしたが、0.17 では動作します。ただし速度は低下します。0.17 には新バージョンの最適化機能が多く含まれていないためです。