往下拉回到首頁
你的 AI 助手其實有「隱藏人格」?MIT 發現大型語言模型暗藏的偏見和情緒

你的 AI 助手其實有「隱藏人格」?MIT 發現大型語言模型暗藏的偏見和情緒

Exposing biases, moods, personalities, and abstract concepts hidden in large language models

欸你知道嗎,你每天在用的 ChatGPT 或其他 AI 助手,其實內部藏著一堆你看不見的東西——有些莫名的偏見、有些情緒傾向,甚至還有像人一樣的「個性」。MIT 的研究團隊最近開發了一套新方法,可以把這些隱藏的特性挖出來。這就像是把 AI 的心理檔案打開來看,發現它其實對某些話題有偏見、對某些問題的回答方式有特定的「脾氣」。說真的這有點扯,但也滿重要的——因為一旦我們知道 AI 內部藏著什麼,就能修正它、讓它更安全更可靠。簡單來說,未來的 AI 就不會莫名其妙地給你奇怪的答案了。

相關標籤

large language modelsbiasvulnerabilitiessafetyLLM performanceabstract concepts