往下拉回到首頁
2b 還是不 2b?客製化大型語言模型排程競賽

2b 還是不 2b?客製化大型語言模型排程競賽

2b or not 2b? Custom LLM Scheduling Competition

嘿各位,我剛推出一個 Kaggle 競賽,主要在解決一個很實際的問題:資源管理和降低 LLM 回應的 token 成本。核心挑戰很簡單但很聰明——給你 MMLU 基準測試的問題,你不是要回答它,而是要決定:用小型 2B 模型還是更大的模型?目標是找到準確度和成本效率之間的完美平衡點。我計畫隨著時間推移加入更多模型,讓決策變得更複雜精細。如果你對優化 AI 推論成本或探索不同模型大小在真實基準上的表現有興趣,這個競賽值得參加:https://www.kaggle.com/competitions/llm-scheduling-competition