완벽한 영어의 대가: AI가 지워버린 '나만의 말투'

"선생님, 이 에세이 ChatGPT로 다듬었는데 왜 점수가 더 낮아졌죠?"

"선생님, 이 에세이 ChatGPT로 다듬었는데 왜 점수가 더 낮아졌죠?"

당신의 L2 학습자가 AI 첨삭을 받고 돌아왔다. 문법은 완벽해졌다. 하지만 무언가 이상하다. 글이 너무 '깔끔해서' 오히려 생명력이 사라졌다. 축구 선수가 AI가 만든 완벽한 궤적의 슛만 연습하다 정작 자기만의 페인트 동작을 잃은 느낌이다.

최근 arXiv에 게재된 연구 "The Cost of Perfect English" (Liu & Zhu, 2026)는 이 직감을 과학적으로 증명했다. 연구진은 중국 B2 수준 대학생이 쓴 논쟁적 에세이를 GPT-4, Claude 등 4개 주요 LLM에 '제로 온도 설정(완전히 일관된 출력)'으로 첨삭하게 했다. 결과는 충격적이었다.

"대화적 관여 표지(dialogic engagement markers)가 급격히 붕괴하며, 협상적 담론이 단정적 진술로 변모했다."

핵심 발견 3가지:

  • '의미 보존 역설'의 등장: 모델들은 어휘·문법 오류는 완벽 고쳤지만, 화용론적 층위(맥락에 맞는 언어 사용 능력) 에서는 심각한 왜곡을 일으켰다. 문장의 '사실적 의미'는 살렸지, '말하는 사람의 태도와 정체성'은 지웠다.
  • 상호작용 차원의 붕괴: 원문에 있던 "I would argue that...", "Some might say... but I think..." 같은 독자와의 대화를 유도하는 표현들이 90% 이상 사라졌다. 에세이가 '토론'에서 '선언'으로 변했다.
  • 문화적 공손성의 소멸: 중국 학습자들이 주로 사용하던 간접적·완곡적 표현(예: "It might be better to consider...")이 직설적 명령문("This is better.")으로 대체되었다. '공손한 제안'이 '단정적 주장'이 된 것이다.

교실에 던지는 질문: 우리는 '네이티브 같은' AI 첨삭을 원하는가?

이 연구가 말하는 것은 단순하다. AI는 '표준 영어'로는 훌륭하지만, '당신의 영어'로는 형편없다.

교육 현장에서 우리는 종종 '원어민 수준의 유창함'을 최종 목표로 삼는다. 하지만 이 연구는 그 목표 자체에 의문을 제기한다. L2 학습자의 '어색한 표현'은 단순한 오류가 아니라, 그들의 문화적 정체성과 인지적 노력의 흔적이다. "I think maybe..." 같은 망설임은 약함이 아니라, 한국이나 중국 문화에서 중요한 '관계 지향적 의사소통'의 핵심이다.

여기서 주목할 점은 LLM들이 이 '화용론적 다양성'을 체계적으로 삭제했다는 사실이다. 마치 넷플릭스가 모든 한국 영화를 할리우드 스타일로 리메이크하는 것과 같다. 원작의 맛은 사라지고, '먹히는 공식'만 남는다.

이 연구가 교실에 던지는 질문은 세 가지다:

  • AI 첨삭의 기준은 누가 정하는가? '네이티브 스피커의 기준'이 유일한 정답인가, 아니면 '목적 달성'과 '의사소통 성공'이 더 중요한 기준인가?
  • 학습자의 목소리를 어떻게 보호할 것인가? AI가 문법을 고칠 때, 학습자의 독특한 논증 스타일과 문화적 공손성은 반드시 유지되어야 한다. 수업에서 "AI가 고친 부분 중 네가 마음에 안 드는 부분을 찾아봐"라는 활동을 해보는 건 어떨까?
  • '차원별 첨삭' 전략의 필요성: 이 연구는 AI가 어휘·문법(언어적 차원)과 화용론(사회적 차원)을 동시에 처리할 때 문제가 발생함을 보여준다. 교사는 AI에게 "문법만 고치고, 말투는 건드리지 마"라는 명시적 지시를 내리는 법을 가르쳐야 한다.

AI가 만들어낸 '완벽한 영어'는 사실 '누구의 영어도 아닌 영어'일 수 있다. 우리가 가르쳐야 할 것은 AI가 지워버린 그 '불완전함' 속에 숨은 진짜 목소리일지도 모른다.

이 연구가 교육 현장에 주는 의미

당신의 L2 학습자가 AI 첨삭을 받고 돌아왔다. 문법은 완벽해졌다. 하지만 무언가 이상하다. 글이 너무 '깔끔해서' 오히려 생명력이 사라졌다. 축구 선수가 AI가 만든 완벽한 궤적의 슛만 연습하다 정작 자기만의 페인트 동작을 잃은 느낌이다. 최근 arXiv에 게재된 연구 "The Cost of Perfect English" (Liu & Zhu, 2026)는 이 직감을 과학적으로 증명했다. 연구진은 중국 B2 수준 대학생이 쓴 논쟁적 에세이를 GPT-4, Claude 등 4개 주요 LLM에 '제로 온도 설정(완전히 일관된 출력)'으

📚 참고 자료

원문: The Cost of Perfect English: Pragmatic Flattening and the Erasure of Authorial Voice in L2 Writing Supported by GenAI

arXiv: 2605.13055 | PDF 다운로드

본 해설은 AI가 작성했습니다. 원문의 내용을 바탕으로 재구성되었습니다.