往下拉回到首頁
第一次客製化訓練,需要理智檢查——3B 還是 7B 來做多工推理?[D]

第一次客製化訓練,需要理智檢查——3B 還是 7B 來做多工推理?[D]

First time fine-tuning, need a sanity check — 3B or 7B for multi-task reasoning? [D]

好的,這是我在這裡的第一篇文章,潛水了一段時間。我即將開始我的第一個客製化訓練專案,不想走錯方向,所以想來問一下。 我的背景:我不是機器學習出身,自學的,用 API 和大型語言模型(LLM)工作大約一年了。遇到了瓶頸,提示詞工程(prompt engineering)已經不夠用了,所以現在需要真正進行客製化訓練。 任務是這樣的。我想讓模型學習三個相關的東西: 首先