往下拉回到首頁
我實測 9 個 AI 模型玩飛行戰鬥遊戲,結果超意外——便宜的量化版本竟然贏了

我實測 9 個 AI 模型玩飛行戰鬥遊戲,結果超意外——便宜的量化版本竟然贏了

I tested 9 local models on the same flight sim prompt, all Q8, different Q providers, MLX

欸你知道嗎,我最近做了個有趣的實驗。我給 9 個不同的本地 AI 模型同一個任務:寫出一個飛行戰鬥遊戲的程式碼。這就像是給 9 個人同樣的食譜,看誰做出來的菜最好吃。 結果超有趣——我原本以為參數越多、模型越大就越強,但實際上不同的量化方式(簡單來說就是把 AI 模型「壓縮」的方法)影響超大。有些便宜的量化版本反而比大模型表現得更好,而且速度還快。 我測試的標準很嚴格:遊戲要真的能玩,要有三種飛機可選、敵機會動、有槍火效果、撞到地面會螺旋墜落。說真的有點扯,有些模型寫出來的程式碼根本跑不起來,但有些小模型卻完美達成。 如果你在考慮用本地 AI 做開發,這個實驗結果可能會改變你對「大就是好」的想法。