
OpenAI ライブストリーム
OpenAIがライブストリーム配信イベントを開催します。放送中に具体的な発表、新製品発表、またはデモンストレーションが明かされる予定です。
OpenAIが前回予告なしのライブストリームをやった時、GPT-4 Turboをドロップして、一晩で価格設定を完全に変えました

会社用に RTX Pro 6000 Blackwell ワークステーションカードを導入しました。Qwen3 27B FP8 モデルで良好なスループット(TPS)を達成しています。特定のタスクに特化した複数の AI エージェントを実行中です。vllm 0.20.1 nightly(CUDA 13.1)で速度と並行処理のバランスを最適化したいところです。 エンジン 000 の現在の状態:平均プロンプトスループット 763.5 tokens/s、平均生成スループット 1320.2 tokens/s、実行中リクエスト 28、待機中リクエスト 0、GPU KV キャッシュ使用率 50.4%、プレフィックスキャッシュヒット率 1.3%、マルチモーダルキャッシュヒット率 0%。