往下拉回到首頁
Qwen3.5-27B、Qwen3.5-122B 和 Qwen3.6-35B 在 4x RTX 3090 上的表現——混合專家模型在嚴格全域規則下吃虧

Qwen3.5-27B、Qwen3.5-122B 和 Qwen3.6-35B 在 4x RTX 3090 上的表現——混合專家模型在嚴格全域規則下吃虧

Qwen3.5-27B, Qwen3.5-122B, and Qwen3.6-35B on 4x RTX 3090 — MoEs struggle with strict global rules

潛水多年首次發文。在 4x RTX 3090 上對三個 Qwen 模型進行了 20+ 次實際代理工作測試——Qwen3.5-27B 密集模型、Qwen3.5-122B-A10B 混合專家模型、Qwen3.6-35B-A3B 混合專家模型。以下數據來自 vLLM 日誌在持續有機負載下的解析,而非合成基準測試。工作負載背景對本文中的每個數字都很重要:該系統是一個多代理協調器,運行 1-6 個並行 OpenCode 會話,提示詞長度 30-60k 令牌,並強制執行嚴格的 bash 允許清單——確切的 uv