스스로 배우는 AI, 착하게 만들 수 있을까

스스로 배우는 AI, 착하게 만들 수 있을까
AI 생성 이미지
아직 이 분야를 모르는 분들을 위해 쉽게 설명하면, 이 논문은 스스로 궁금해하며 배우는 인공지능이 과연 사람 말을 잘 들을 수 있을까 하는 질문을 다룹니다.

요즘 인공지능은 정말 빠르게 똑똑해졌습니다. 글도 쓰고 그림도 그리고 시험 문제도 풉니다. 그런데 이런 인공지능은 대부분 이미 모아둔 자료를 잔뜩 보고 배웁니다. 사람이 하나하나 칭찬하고 고쳐주는 과정도 거칩니다. 문제는 로봇처럼 실제 세상에서 움직여야 할 때입니다. 처음 보는 길, 갑자기 튀어나온 장애물 앞에서는 미리 배운 자료가 별 도움이 되지 않습니다. 결국 그 자리에서 직접 부딪히며 배우는 수밖에 없습니다.

스스로 궁금해하는 마음, 내적 동기

그래서 연구진이 주목한 것이 내적 동기입니다. 어렵게 들리지만 호기심이라고 생각하면 됩니다. 저건 뭐지, 이렇게 하면 더 잘할 수 있지 않을까 하는 마음이 로봇을 움직이게 한다는 것입니다. 당근을 주지 아도 스스로 돌아다니며 탐험하게 만드는 힘입니다. 이렇게 하면 로봇은 낯선 곳에서도 요령을 터득합니다. 그런데 여기서 곤란한 문제가 생깁니다. 너무 자유로워진다는 점입니다.

자유로워질수록 어려워지는 정렬

정렬이라는 말이 있습니다. 인공지능이 하는 행동을 사람이 원하는 방향에 맞추는 일입니다. 자율성이 커질수록 이 일은 훨씬 어려워집니다. 규칙을 미리 정해두면 낯선 상황에서 쓸모가 없고, 규칙을 정해두지 않으면 로봇이 엉뚱한 길로 샐 수 있습니다. 연구진은 이 딜레마를 풀기 위해 발달적 틀이라는 생각을 내놓습니다. 규칙을 미리 심는 대신, 자라면서 익히게 하자는 것입니다.

발달적 틀은 아이가 크는 과정을 떠올리면 이해가 쉽습니다. 아이는 규칙을 통째로 외워서 사회생활을 배우지 않습니다. 부딪히고, 혼나고, 옆 사람을 보며 조금씩 익힙니다. 인공지능도 똑같이 사람과 어울리는 가운데 사회 규범을 배우게 하자는 것입니다. 이때 호기심은 없애야 할 것이 아니라, 방향을 잡아주어야 할 것으로 바뀝니다.

우리 생활에는 어떤 의미가 있을까

이 연구가 의미하는 바는 분명합니다. 앞으로 집 안을 돌아다니는 돌봄 로봇이나 배달 로봇이 흔해지면, 미리 정한 규칙만으로는 안전을 보장하기 어렵습니다. 사람이 많은 복도에서 어떻게 비켜설지, 낯선 손님 앞에서 어떻게 행동할지는 그때그때 배워야 합니다. 교육 현장도 비슷합니다. 정답을 외우게 하는 교육보다, 스스로 탐색하며 사회적 약속을 익히게 하는 경험이 더 중요해질 수 있습니다. 결국 로봇을 사람답게 만드는 일은 사람을 기르는 일과 닮아 있습니다.

📖 원문 보기: arXiv 원문

본 요약은 AI로 작성되었습니다. arXiv 논문을 바탕으로 재구성되었습니다.