AI 교육 도구, 성격 바꾸니 문제가 생겼다
요즘 학교에서는 AI가 학생 숙제를 채점하거나 문제를 만드는 일이 늘고 있다. 그런데 AI의 답변을 조종하는 기술이 등장하면서 걱정이 생겼다. 이 기술은 '활성 기반 조종'이라고 부르는데, 쉽게 말해 AI가 내놓는
인공지능(AI)이 학생 답안을 채점하거나 문제를 낼 때, AI의 '성격'을 바꾸면 어떤 일이 생길까? 연구진이 이 궁금증을 직접 실험해봤다.
AI에게 '착한 척'을 시키면?
요즘 학교에서는 AI가 학생 숙제를 채점하거나 문제를 만드는 일이 늘고 있다. 그런데 AI의 답변을 조종하는 기술이 등장하면서 걱정이 생겼다. 이 기술은 '활성 기반 조종'이라고 부르는데, 쉽게 말해 AI가 내놓는 답을 원하는 방향으로 살짝 밀어주는 방법이다. 예를 들어 '친절한 선생님'처럼 답하게 만들 수 있다. 연구진은 이 기술이 교육 현장에서 어떤 영향을 주는지 궁금해했다. 특히 학생 답안을 평가하는 일에 문제가 생길 수 있다고 봤다.
과학 문제보다 영어 문제가 11배 더 민감했다
연구진은 7가지 다른 성격(착함, 나쁨, 예의 바름, 무례함, 낙관적, 비관적, 공정함)을 AI에 심어 실험했다. 결과는 충격적이었다. AI의 성격을 바꾸면 답안의 질이 전체적으로 떨어졌다. 특히 주관식 문제에서 효과가 컸다. 과학 문제처럼 사실을 묻는 문제보다 영어 과목처럼 의견을 쓰는 문제에서 11배나 더 민감하게 반응했다. 채점 쪽에서는 더 재미있는 현상이 나타났다. '나쁜' 성격을 가진 AI는 학생에게 더 엄격한 점수를 줬고, '착한' AI는 더 후하게 점수를 줬다. 이런 차이는 영어 과목에서 과학 과목보다 2.5~3배 더 컸다.
또 한 가지 흥미로운 점은 AI 모델의 종류에 따라 차이가 크게 벌어졌다는 것이다. '전문가 혼합 모델'이라는 특별한 구조의 AI는 일반 AI보다 6배나 더 큰 점수 차이를 보였다. 이는 같은 기술을 쓰더라도 AI의 구조에 따라 효과가 천차만별이라는 뜻이다.
교육 현장에 주는 의미
이 연구가 의미하는 바는 분명하다. AI를 교육에 쓸 때는 '성격 조종' 기술을 조심해야 한다는 것이다. 특히 학생의 창의력이나 생각을 평가하는 주관식 과목에서 더 큰 문제가 생길 수 있다. 만약 AI 채점자가 의도치 않게 '까칠한 성격'을 가지게 된다면, 학생들은 억울하게 낮은 점수를 받을 수도 있다. 반대로 '너무 착한' AI는 실력이 부족한 학생을 합격시킬 위험도 있다. 앞으로 학교에서 AI를 도입할 때는 이런 점을 꼭 고려해야 할 것이다.
원문 보기: arXiv 원문
본 요약은 AI로 작성되었습니다. arXiv 논문을 바탕으로 재구성되었습니다.