
OpenAI ライブストリーム
OpenAIがライブストリーム配信イベントを開催します。放送中に具体的な発表、新製品発表、またはデモンストレーションが明かされる予定です。
OpenAIが前回予告なしのライブストリームをやった時、GPT-4 Turboをドロップして、一晩で価格設定を完全に変えました

ノートパソコンのRTX 4060(8GB VRAM)でQwen3.6-35B-A3Bを動かすことに成功したので、その設定方法をシェアしたいと思います。ただし、これはカジュアルなチャット用ではなく、より大きなAIパイプラインの中でコーディング用のサブエージェントとして使っているので、設定の一部はそのユースケースに特化しています。一番厄介だったのは、無制限の思考モード(thinking)がクラッシュせずに静かにmax_tokensの予算全体を消費していたこと。思考機能を無効にしたら解決しましたが、実はトークンごとの制限を使うというもっとスマートな方法もあります。限られたハードウェアで強力なモデルを特定のタスク用に動かしたいなら、この記事は何時間ものデバッグ時間を節約できるはずです。