
OpenAI 라이브스트림
OpenAI가 라이브스트림 이벤트를 개최합니다. 방송 중에 구체적인 발표, 신제품 출시 또는 시연이 공개될 예정입니다.
The last time OpenAI did an unannounced livestream, they dropped GPT-4 Turbo and changed pricing overnight

RTX 3060 6GB, RAM 40GB 노트북에서 Qwen 3.6 35B를 실행하려고? 솔직히 말하면 기술적으로는 가능하지만 심각한 제약이 있습니다. 35B 모델을 4비트 양자화(Q4)하면 대략 18~20GB의 VRAM이 필요한데, 이는 상당 부분을 시스템 RAM으로 오프로드해야 한다는 뜻입니다. RTX 3060 Mobile이 최선을 다하겠지만 추론 속도는 느려질 겁니다——GPU와 RAM 사이의 데이터 이동량에 따라 대략 5~15 토큰/초 정도입니다. PDF 요약처럼 시간이 여유로운 작업이라면 실제로 사용 가능한 수준입니다. 진짜 병목은 뭘까요? 4코어 CPU와 PCIe 대역폭이 데이터 교환 시 성능을 떨어뜨립니다. 먼저 더 작은 모델(13B 같은)로 테스트해서 정말 필요한지 확인한 후 진행하길 권장합니다. llama.cpp나 Ollama 같은 도구로 최적화하세요.