往下拉回到首頁
Marul V7:從零開始訓練的土耳其語大型語言模型,擁有 2.58 億參數

Marul V7:從零開始訓練的土耳其語大型語言模型,擁有 2.58 億參數

Meet Marul V7: A Turkish LLM Built From Scratch With 258M Parameters

有個開發者剛推出了 Marul V7,一個完全從零開始訓練的土耳其語言模型——沒有借用現成架構,沒有偷懶。這個模型有 2.58 億個參數,用自己開發的分詞器(tokenizer)和模型架構訓練而成,預訓練階段完全使用乾淨的土耳其語文本,之後還進行了指令微調(instruction tuning)。結果就是一個真正理解土耳其語的模型,不是某個大模型的微調版本。如果你在乎 AI 是否尊重語言的細微差別,這個值得看看。