아래로 당겨서 돌아가기
자신감 넘치는 AI를 잡아내는 새로운 방법이 나왔다

자신감 넘치는 AI를 잡아내는 새로운 방법이 나왔다

A better method for identifying overconfident large language models

ChatGPT 같은 AI가 완전히 틀린 말을 자신감 있게 하는 거 봤죠? 연구자들이 새로운 측정 방식을 개발해서 대형언어모델(LLM)이 자기 답변에 얼마나 확신하는지 판단할 수 있게 됐어요. 쉽게 말해서, AI가 "이건 확실해"라고 말하는데 이 새로운 지표가 "사실 불확실해"라고 나타나면 빨간불이 켜지는 거예요. 즉, AI가 환각(hallucination)을 일으키고 있을 가능성이 있다는 뜻입니다. 일에서 AI를 쓰려는 사람들한테는 정말 중요한 기술인데, 이제 "이때는 AI를 믿어도 돼", "이때는 내가 확인해야 해"라는 판단을 할 수 있게 되는 거죠.

키워드

overconfidenceLLMuncertaintyhallucinationsAI reliabilitytrustmetric