下に引いて戻る
CloudeCode で Qwen3.6-27B-UD-Q6_K_XL.gguf を試したら、まさか実用的だとは

CloudeCode で Qwen3.6-27B-UD-Q6_K_XL.gguf を試したら、まさか実用的だとは

Tried Qwen3.6-27B-UD-Q6_K_XL.gguf with CloudeCode, well I can't believe but it is usable

RTX 5090 で llama.cpp を使って Qwen3-27B-UD-Q6_K_XL.gguf を 200K コンテキストで実行してみたら、50 tok/s くらいの速度が出ました。悪くないと思いますが、詳しくないので改善の余地があるかもしれません。ただ、ローカルモデル(local models)でコーディングするのは本当に久しぶりなんですが、こんなに実用的になったなんて信じられません。Opus 4.7 のような最高級の体験には及びませんが、本当に差が縮まってきてますね。