코딩 AI 교육, 선생님 간 경쟁 효과
쉽게 말해, 이 연구는 거대한 AI들이 서로 경쟁하고 협력해서 더 작은 AI에게 코딩을 가르치는 새로운 방법을 찾았습니다.
요즘 AI는 다른 AI를 가르치는 '선생님' 역할도 합니다. 하지만 여러 선생님이 있을 때 누구의 말을 따라야 할지 고민이었어요. 기존에는 사람이 만든 평가 기준이 편향될 수 있었죠. 이 연구는 그 문제를 해결했습니다. 연구진은 네 가지 최첨단 AI 선생님을 준비했어요. 클로드, 코덱스-GPT, 그록, 제미니입니다. 이들에게 먼저 코딩 문제를 풀게 하고, 정답 여부를 실제 실행 결과로 판단했습니다. 즉, 주관적인 평가가 아니라 '진짜 실행해보고 맞는지' 확인한 겁니다.
경쟁 결과, 최고 선생님은?
놀라운 점은 쉬운 문제에서는 네 선생님이 모두 거의 완벽하게 풀었다는 겁니다. 하지만 어려운 문제에서는 차이가 났습니다. 제미니가 77%로 가장 높았고, 클로드와 코덱스는 69%, 그록은 50%였습니다. 그런데 중요한 것은, 학생 AI의 실력 향상은 이 순위와 크게 관계가 없었다는 점입니다. 즉, 최고 선생님의 답을 그대로 따라 한다고 학생이 더 잘 배우는 건 아니었습니다.
단순 모방만으로는 부족하다
연구진은 학생 AI가 단순히 정답을 모방하는 것만으로는 진정한 학습이 일어나지 않는다는 사실을 발견했습니다. 그래서 선생님들이 경쟁한 문제들을 모아 체계적인 교육 과정을 만들었습니다. 그 결과 학생 AI는 단순 모방 이상의 실력을 갖추게 되었습니다. 이 연구가 의미하는 바는, AI 교육에서도 '무조건 잘하는 선생님'보다 '체계적인 커리큘럼'이 더 중요할 수 있다는 점입니다. 앞으로 AI 학습법이 어떻게 바뀔지 기대됩니다.
📖 원문 보기: arXiv 원문
본 요약은 AI로 작성되었습니다. arXiv 논문을 바탕으로 재구성되었습니다.