
OpenAI ライブストリーム
OpenAIがライブストリーム配信イベントを開催します。放送中に具体的な発表、新製品発表、またはデモンストレーションが明かされる予定です。
OpenAIが前回予告なしのライブストリームをやった時、GPT-4 Turboをドロップして、一晩で価格設定を完全に変えました

RTX 3060 6GB、RAM 40GBのノートパソコンでQwen 3.6 35Bを走らせたい?率直に言うと、技術的には可能ですが、かなり厳しい制限があります。35Bモデルを4ビット量化(Q4)すると、だいたい18~20GBのVRAMが必要になります。つまり、かなりの部分をシステムRAMにオフロードしなければなりません。RTX 3060 Mobileは頑張りますが、推論速度は遅くなります——おそらく5~15トークン/秒程度で、GPU とRAM間のデータ移動量に左右されます。PDF要約みたいな時間に余裕のあるタスクなら、実は使えるレベルです。本当のボトルネックは?4コアのCPUとPCIeの帯域幅がデータ交換時に性能を落とします。まずは小さいモデル(13Bとか)で試して、本当に必要かどうか確認してから進めることをお勧めします。llama.cppやOllamaといったツールで最適化しましょう。