下に引いて戻る
4x RTX 3090上のQwen3.5-27B、Qwen3.5-122B、Qwen3.6-35B——MoEは厳格なグローバルルールで苦戦

4x RTX 3090上のQwen3.5-27B、Qwen3.5-122B、Qwen3.6-35B——MoEは厳格なグローバルルールで苦戦

Qwen3.5-27B, Qwen3.5-122B, and Qwen3.6-35B on 4x RTX 3090 — MoEs struggle with strict global rules

長年のROMから初投稿です。4x RTX 3090上で3つのQwenモデルを20回以上の実際のエージェント作業でテストしました——Qwen3.5-27B密集モデル、Qwen3.5-122B-A10B混合専門家モデル、Qwen3.6-35B-A3B混合専門家モデル。以下の数値はvLLMログから継続的な実負荷下で解析したもので、合成ベンチマークではありません。このポストのすべての数値に関連する作業負荷コンテキスト:このシステムは1~6個の並行OpenCodeセッションを実行するマルチエージェントオーケストレータで、30~60kトークンのプロンプトを使用し、厳格なbashホワイトリストを強制します——正確なuv