往下拉回到首頁
終於有辦法抓出 AI 在唬爛了——新方法能看穿它的假信心

終於有辦法抓出 AI 在唬爛了——新方法能看穿它的假信心

A better method for identifying overconfident large language models

欸你知道嗎,你問 ChatGPT 問題時,它有時候會超自信地回答你,但其實根本在亂掰?現在有科學家開發出一套新的方法,可以測出 AI 到底有多確定自己說的是對的。這就像是你問朋友一個問題,他可能會很篤定地說答案,但其實他根本不知道——新方法就是能抓出這種「假信心」。簡單來說,如果 AI 說某件事時信心滿滿,但這套新指標卻顯示它其實不太確定,那就代表它可能在胡說八道(我們叫這個「幻覺」)。對於想在工作上用 AI 的人來說,這真的超重要,因為你終於可以知道什麼時候該相信它、什麼時候要自己查一下。說真的,這個發現有點扯,因為以前我們根本沒辦法判斷 AI 是真的知道還是在唬爛。

相關標籤

overconfidenceLLMuncertaintyhallucinationsAI reliabilitytrustmetric