往下拉回到首頁
欸你知道嗎?自己買張顯卡跑 AI 模型,速度快到爆炸還省錢

欸你知道嗎?自己買張顯卡跑 AI 模型,速度快到爆炸還省錢

Qwen3.5-27B on RTX 5090 served via vLLM @ 77 tps

如果你有在用 ChatGPT 或其他 AI 工具,應該知道訂閱費用有多扯吧?這個人乾脆自己買了張 RTX 5090 顯卡,在家裡跑 Qwen3.5 這個開源 AI 模型。說真的效果超好,每秒可以處理 77 次推論,比很多線上服務還快。而且一次還能跑 2 個對話,就像同時開 2 個 ChatGPT 視窗一樣。唯一的小問題是要調整一下軟體版本才能跑得最順,但整體來說根本是划算到不行——一次投資,永遠省錢。如果你也常常被 AI 訂閱費用搞到荷包大失血,這個方案可能值得你看看。