往下拉回到首頁
欸你知道嗎?用筆電的 RTX 3060 跑 Qwen 35B 根本不可能吧?

欸你知道嗎?用筆電的 RTX 3060 跑 Qwen 35B 根本不可能吧?

Can you actually run Qwen 3.6 35B on a laptop with RTX 3060? Here's what to expect

如果你有在用筆電想跑大型 AI(Qwen 3.6 35B),我先跟你說實話:可以是可以,但會超級卡。簡單來說就是,一個 35B 的模型量化到 Q4 要吃掉 18-20GB 的顯存,你的 RTX 3060 只有 6GB,所以一堆東西得放在 RAM 裡面,然後一直在 GPU 和 RAM 之間搬來搬去。這就像是你要搬家,東西太多放不進車子,只好一趟一趟來回跑,超浪費時間。你的推理速度大概會是 5-15 個 token/秒,說真的有點慢,但如果你只是要拿來摘要 PDF 這種不趕時間的工作,其實還能接受啦。真正會卡你的是 CPU 和那條連接 GPU 的線路(PCIe)太窄了,資料搬運會變成瓶頸。我的建議?先試試看小一點的模型(像 13B),看看夠不夠用,省得自己折騰。用 llama.cpp 或 Ollama 這些工具來調整設定,說不定會好一點。