
OpenAI 라이브스트림
OpenAI가 라이브스트림 이벤트를 개최합니다. 방송 중에 구체적인 발표, 신제품 출시 또는 시연이 공개될 예정입니다.
The last time OpenAI did an unannounced livestream, they dropped GPT-4 Turbo and changed pricing overnight

RTX 5090에서 llama.cpp로 Qwen3-27B-UD-Q6_K_XL.gguf를 200K 컨텍스트로 실행해봤는데 약 50 tok/s 정도 나옵니다. 나쁘지 않은 것 같은데, 이 분야를 잘 몰라서 더 개선할 여지가 있을 수도 있습니다. 어쨌든 로컬 모델(local models)로 코딩하는 건 정말 오랜만인데, 정말 이 정도면 실용적이 되었다니 믿기지 않네요. 물론 Opus 4.7 같은 최고 수준의 경험과는 비교가 안 되지만, 정말 격차가 줄어들고 있습니다.