아래로 당겨서 돌아가기
CloudeCode로 Qwen3.6-27B-UD-Q6_K_XL.gguf 돌려봤는데, 정말 쓸 만하네

CloudeCode로 Qwen3.6-27B-UD-Q6_K_XL.gguf 돌려봤는데, 정말 쓸 만하네

Tried Qwen3.6-27B-UD-Q6_K_XL.gguf with CloudeCode, well I can't believe but it is usable

RTX 5090에서 llama.cpp로 Qwen3-27B-UD-Q6_K_XL.gguf를 200K 컨텍스트로 실행해봤는데 약 50 tok/s 정도 나옵니다. 나쁘지 않은 것 같은데, 이 분야를 잘 몰라서 더 개선할 여지가 있을 수도 있습니다. 어쨌든 로컬 모델(local models)로 코딩하는 건 정말 오랜만인데, 정말 이 정도면 실용적이 되었다니 믿기지 않네요. 물론 Opus 4.7 같은 최고 수준의 경험과는 비교가 안 되지만, 정말 격차가 줄어들고 있습니다.