往下拉回到首頁
用 CloudeCode 跑 Qwen3.6-27B-UD-Q6_K_XL.gguf,我真的不敢相信它竟然能用

用 CloudeCode 跑 Qwen3.6-27B-UD-Q6_K_XL.gguf,我真的不敢相信它竟然能用

Tried Qwen3.6-27B-UD-Q6_K_XL.gguf with CloudeCode, well I can't believe but it is usable

我在 RTX 5090 上用 llama.cpp 跑 Qwen3-27B-UD-Q6_K_XL.gguf,支援 200K 的上下文長度,速度大約是 50 tok/s,還不錯吧,我也不太懂這些細節,應該還有優化空間。但重點是,我已經很久沒試過本地模型(local models)來寫程式了,天啊,我們居然已經進步到真的能用的程度?當然比不上 Opus 4.7 那種一流的體驗,但老實說,我們越來越接近了。