AI 평가 도구, 대학 시험을 바꾸다

요즘 대학가에선 학생들이 챗GPT 같은 AI 도구를 써서 리포트를 쓰는 게 흔해졌습니다. 그런데 교수들은 '이걸 어디까지 허용해야 할까?' 고민이 깊어졌죠. 이번 논문은 바로 그 고민을 해결하려는 'AI 평가 기준'이라는 도구를 실제 대학에서 써본 경험을 분석했습니다.

이 연구는 베트남과 영국에 있는 두 대학에서 교수 30명을 모아 면담을 진행했습니다. 연구진은 '생성형 AI'라는 기술, 즉 사용자가 질문하면 새로운 글, 그림, 코드 등을 만들어내는 인공지능을 어떻게 평가에 활용할지에 대한 기준을 만들었죠. 이 기준을 'AI 평가 척도'라고 부르는데, 쉽게 말해 과제에서 'AI를 어디까지 써도 되는지'를 단계별로 나눠놓은 표입니다. 예를 들어 1단계는 AI 사용 금지, 5단계는 AI와 함께 작업하는 식입니다. 연구진은 이 기준을 실제로 교수들이 어떻게 받아들이고 사용하는지 집중적으로 살폈습니다.

교수들이 발견한 'AI의 두 얼굴'

면담 결과 교수들은 AI 평가 척도가 '공통 언어' 역할을 한다고 말했습니다. 대학 안에서 'AI를 써도 되는지, 안 되는지'를 서로 명확히 이야기할 수 있는 기준이 생긴 거죠. 특히 교수들은 이 척도 덕분에 학생들이 AI를 쓸 때 '여기까지만 써야 한다'는 경계를 분명히 알게 됐다고 평가했습니다. 하지만 한편으로는 대학이 AI 사용을 너무 엄격하게 규제하면 오히려 학생들이 몰래 쓰거나, 교수들이 새로운 기술을 배우는 데 어려움을 겪는다는 문제도 드러났습니다.

연구가 주는 교훈: '기준' 하나로 끝나는 게 아니다

이 연구에서 가장 흥미로운 점은 AI 평가 척도가 '만능 해결사'가 아니라는 사실입니다. 교수들은 이 기준을 통해 AI 사용을 더 잘 통제할 수 있었지만, 동시에 '이 기준이 오히려 교육의 창의성을 막을 수도 있다'는 우려도 내비쳤습니다. 연구진은 결국 중요한 건 기준 자체보다 'AI를 어떻게 교육에 통합할 것인가'라는 더 큰 질문이라고 강조합니다. 예를 들어 AI로 만든 답변을 분석하는 수업을 하거나, 학생들이 AI와 협업하는 과정을 평가하는 방법 등이 필요하다는 거죠.

이 연구가 우리에게 주는 메시지는 분명합니다. AI 기술은 이미 우리 일상에 깊숙이 들어왔고, 대학도 이를 무시할 수 없습니다. 중요한 건 학생들을 'AI 사용자'가 아닌 'AI를 비판적으로 활용할 수 있는 사람'으로 키우는 교육 방식의 변화입니다. 앞으로 더 많은 대학이 이런 기준을 도입할 것으로 보이며, 이 과정에서 교수와 학생 모두의 목소리가 반영되어야 할 것입니다.

📖 원문 보기: arXiv 원문

본 요약은 AI로 작성되었습니다. arXiv 논문을 바탕으로 재구성되었습니다.