往下拉回到首頁
我在 MacBook Air M5 上實測了 21 個本地大型語言模型的程式碼品質和速度

我在 MacBook Air M5 上實測了 21 個本地大型語言模型的程式碼品質和速度

I benchmarked 21 local LLMs on a MacBook Air M5 for code quality AND speed

網路上到處都是「相信我,這個模型寫程式碼最強」的討論,但根本沒人拿出真正的數據。我決定用實際測試來說話:到底哪個模型寫出來的程式碼最正確,在真實硬體上跑得有多快。所有測試都在完全相同的條件下進行,結果才能真正比較。沒有挑選特定的提示詞,沒有主觀印象,就是用 164 個程式碼問題的擴展測試套件來測 pass@1 通過率。 硬體:MacBook Air M5,32 GB 統一記憶體 量化方式:所有模型都用 llama.cpp 的 Q4_K_M 量化