
OpenAI ライブストリーム
OpenAIがライブストリーム配信イベントを開催します。放送中に具体的な発表、新製品発表、またはデモンストレーションが明かされる予定です。
OpenAIが前回予告なしのライブストリームをやった時、GPT-4 Turboをドロップして、一晩で価格設定を完全に変えました

RTX 5090 で llama.cpp を使って Qwen3-27B-UD-Q6_K_XL.gguf を 200K コンテキストで実行してみたら、50 tok/s くらいの速度が出ました。悪くないと思いますが、詳しくないので改善の余地があるかもしれません。ただ、ローカルモデル(local models)でコーディングするのは本当に久しぶりなんですが、こんなに実用的になったなんて信じられません。Opus 4.7 のような最高級の体験には及びませんが、本当に差が縮まってきてますね。