往下拉回到首頁
終於有辦法抓出自信過頭的 AI 了——新方法能識別那些亂掰的模型

終於有辦法抓出自信過頭的 AI 了——新方法能識別那些亂掰的模型

A better method for identifying overconfident large language models

你知道 ChatGPT 有時候會很篤定地說出完全錯誤的東西嗎?科學家們現在開發出一套新的測量方式,可以偵測大型語言模型(LLM)到底有多確定自己說的是對的。簡單來說就是,這個方法能幫你判斷 AI 是在唬爛還是真的知道答案。如果 AI 說某件事時信心滿滿,但這套新指標卻顯示它其實不太確定,那就是警訊——代表它可能在幻覺(hallucination)。這對想要在工作上用 AI 的人來說超重要,因為你終於可以知道什麼時候該相信它、什麼時候要自己查證。

關鍵字

overconfidenceLLMuncertaintyhallucinationsAI reliabilitytrustmetric