
OpenAI 라이브스트림
OpenAI가 라이브스트림 이벤트를 개최합니다. 방송 중에 구체적인 발표, 신제품 출시 또는 시연이 공개될 예정입니다.
The last time OpenAI did an unannounced livestream, they dropped GPT-4 Turbo and changed pricing overnight

사용자가 Qwen3.6을 3가지 다른 양자화 방식(llama.cpp, ik_llama.cpp, Turboquant)으로 테스트했습니다. 환경은 2개의 GPU(3080과 3060, 각 12GB)이고, 양자화 파라미터(turbo3 vs q8_0)를 제외한 모든 설정은 동일합니다. 결과는 Turboquant만 실패했고 다른 2가지 방식은 정상 작동했습니다. TheTom/llama-cpp-turboquant 구현을 사용 중입니다. 제한된 VRAM으로 로컬에서 Qwen3.6을 실행하려면 Turboquant는 아직 안정적이지 않을 수 있다는 경고입니다.