아래로 당겨서 돌아가기
4x RTX 3090에서의 Qwen3.5-27B, Qwen3.5-122B, Qwen3.6-35B — MoE는 엄격한 글로벌 규칙에서 어려움

4x RTX 3090에서의 Qwen3.5-27B, Qwen3.5-122B, Qwen3.6-35B — MoE는 엄격한 글로벌 규칙에서 어려움

Qwen3.5-27B, Qwen3.5-122B, and Qwen3.6-35B on 4x RTX 3090 — MoEs struggle with strict global rules

오래 잠수하다가 처음 글을 올립니다. 4x RTX 3090에서 3개의 Qwen 모델을 20회 이상의 실제 에이전트 작업으로 테스트했습니다——Qwen3.5-27B 밀집 모델, Qwen3.5-122B-A10B 혼합 전문가 모델, Qwen3.6-35B-A3B 혼합 전문가 모델. 아래 수치는 지속적인 실제 부하 상황에서 vLLM 로그로부터 파싱한 것이며, 합성 벤치마크가 아닙니다. 이 글의 모든 수치와 관련된 워크로드 컨텍스트: 이 시스템은 1~6개의 동시 OpenCode 세션을 실행하는 멀티 에이전트 오케스트레이터이며, 30~60k 토큰 프롬프트를 사용하고 엄격한 bash 허용 목록을 강제합니다——정확한 uv