AI가 자신의 실수를 깨닫게 하는 법

AI가 내놓는 답이 과연 믿을 만한지, AI 스스로 판단하게 하는 훈련법이 등장했습니다. 이 방법은 AI가 두 가지 추론 과정을 비교하면서 스스로 배우도록 합니다.

왜 이 연구가 필요했나?

인공지능 챗봇이나 AI 비서가 최근 부쩍 자신감 넘치는 답변을 하곤 합니다. 하지만 그 답이 틀렸을 때도 확신에 차 있다면 문제가 됩니다. 예를 들어 수학 문제를 틀리면서도 '정답은 42입니다'라고 당당하게 말하는 식이죠. 기존의 훈련 방법들은 AI에게 '모르면 모른다고 말해'라고 직접 가르쳤습니다. 그런데 이렇게 하면 AI가 진짜로 문제를 이해하지 못해도 그냥 회피하는 법만 배울 수 있습니다.

새로운 훈련법: 짝 비교 학습

연구진은 '인지적 짝 비교 훈련'이라는 새로운 방법을 제안했습니다. 이 방법은 AI에게 같은 문제에 대한 두 가지 추론 과정을 보여주고, 어떤 추론이 더 타당한지 고르게 합니다. 마치 선생님이 학생에게 '이 풀이와 저 풀이 중 어떤 게 더 논리적이니?'라고 묻는 것과 비슷합니다. 이렇게 하면 AI는 단순히 답을 맞추는 것을 넘어서, 추론 과정 자체의 질을 평가하는 능력을 기르게 됩니다.

실제 결과는?

이 방법을 다양한 크기와 종류의 AI 모델에 적용해 본 결과, 모두에서 성능이 개선되었습니다. 특히 140억 개의 뉴런(매개변수)을 가진 모델에서는 수학 문제 정답률이 2.2% 올랐고, 자신 없을 때 적절히 거절하는 능력은 5.2%나 향상됐습니다. 다시 말해, AI가 더 정확해지면서도 자신의 한계를 잘 인식하게 된 것입니다. 연구진은 5가지 크기와 3가지 종류의 모델에서 이 같은 효과를 확인했습니다.

의미와 전망

이 연구가 중요한 이유는 AI의 '메타인지(자신의 생각을 스스로 평가하는 능력)'를 실제로 개선하는 방법을 보여줬기 때문입니다. 앞으로 AI 비서, 교육용 AI, 의료 진단 등에서 더 믿을 수 있는 답변을 기대할 수 있게 되었습니다. 단순히 답을 외우는 AI가 아니라, 자신의 한계를 인식하고 더 현명하게 행동하는 AI로 발전하는 데 도움이 될 것입니다.

📖 원문 보기: arXiv 원문

본 요약은 AI로 작성되었습니다. arXiv 논문을 바탕으로 재구성되었습니다.