
OpenAI 라이브스트림
OpenAI가 라이브스트림 이벤트를 개최합니다. 방송 중에 구체적인 발표, 신제품 출시 또는 시연이 공개될 예정입니다.
The last time OpenAI did an unannounced livestream, they dropped GPT-4 Turbo and changed pricing overnight

16GB M3 맥북 에어에서 메모리 매핑(mmap) 기술을 사용해 거대한 언어모델인 Qwen 3.5 35B를 성공적으로 실행했습니다. 모델이 RAM보다 훨씬 크다는 점을 고려하면 초당 8.9 토큰이라는 속도는 꽤 괜찮은 결과입니다. 비결이 뭘까요? GGUF 양자화로 모델을 압축하고, mmap으로 디스크와 메모리 간 데이터 교환을 효율적으로 처리하는 것입니다. Hugging Face에서 모델을 다운로드하는 것부터 시작해서 구체적인 설정 단계를 안내해드리겠습니다. 군더더기 없이 맥에서 강력한 AI를 로컬로 실행하고 싶은 사람들을 위한 실용적인 가이드입니다.