
OpenAI ライブストリーム
OpenAIがライブストリーム配信イベントを開催します。放送中に具体的な発表、新製品発表、またはデモンストレーションが明かされる予定です。
OpenAIが前回予告なしのライブストリームをやった時、GPT-4 Turboをドロップして、一晩で価格設定を完全に変えました

16GB の M3 MacBook Air で Qwen 3.5 35B という巨大な言語モデルを、メモリマッピング(mmap)を使って実行することに成功しました。8.9 トークン/秒という速度は、モデルが RAM より遥かに大きいことを考えると、なかなか悪くない結果です。コツは何か?GGUF 量化でモデルを圧縮し、mmap でディスクとメモリ間のデータ交換を効率的に行うことです。Hugging Face からモデルをダウンロードするところから始めて、具体的なセットアップ手順を説明します。余計な説明は抜きにして、Mac でローカルに強力な AI を実行したい人向けの実践的なガイドです。