정답 늦추는 교육 AI, 스스로 푸는 힘 키운다
핵심 요약
주요 AI 기업들이 정답 대신 질문과 힌트를 제공하는 교육 기능을 강화하고 있다. 실험에서는 일반 AI가 당장의 성과를 높였지만 이후 독립적인 판단과 시험 성적이 낮아졌다. 교사 설계형 힌트 AI는 연습 성과를 높이면서 AI 없는 시험의 성적 하락을 막았다.
생성형 인공지능의 경쟁력이던 ‘빠른 정답’이 교육 서비스에서는 의도적으로 늦춰지고 있다. 구글과 오픈AI, 앤스로픽은 답을 즉시 보여주는 대신 단계별 질문과 힌트로 학습자의 사고를 이끄는 기능을 강화하고 있다. AI에 판단을 과도하게 맡길 경우 독립적인 문제 해결 능력이 약해질 수 있다는 우려가 커지면서, 교육 AI의 설계 중심도 정답 제공에서 사고 과정 지원으로 이동하고 있다.
구글은 12일 현재 제미나이를 활용한 교사 주도형 학습 기능을 확대하고 있다. 교사는 구글 클래스룸 수업 자료로 학생별 활동을 만들고 이해도와 어려움을 살필 수 있으며, 지난해 8월 출시된 ‘가이드 러닝’도 학생에게 직접 배정할 수 있다. 이 기능은 내용을 나눠 질문과 힌트를 제시하며, 크롬북 포커스 모드는 학생 화면을 특정 활동에 고정해 일반 AI에서 정답부터 찾는 행동을 제한한다. 오픈AI는 지난해 챗GPT에 ‘스터디 모드’를 도입해 수준별 질문과 인터랙티브 콘텐츠를 강화했고, 부모와 연결된 청소년 계정에서는 새 대화의 기본값으로 지정할 수 있게 했다. 앤스로픽의 교육용 클로드 역시 접근 방법과 결론의 근거를 되묻는 소크라테스식 학습을 적용한다.
AI가 즉각적인 성과를 높이더라도 스스로 판단하는 능력까지 향상시키지는 못한다는 실험 결과도 확인됐다. MIT 미디어랩의 한 달간 실험에서 AI를 사용한 참가자의 가짜 뉴스 판별 정확도는 평균 21%포인트 높아졌지만, 새로운 뉴스를 혼자 판별할 때는 정확도가 처음보다 약 15%포인트 낮아졌다. 미국 펜실베이니아대가 튀르키예 고등학생 약 1000명을 대상으로 진행한 실험에서도 일반 생성형 AI 이용자의 연습 성적은 교과서를 쓴 대조군보다 48% 높았으나, AI 없이 치른 시험 성적은 17% 낮았다.
반대로 교사가 설계한 힌트만 주고 정답은 제공하지 않는 AI 튜터를 이용한 학생은 연습 성적이 127% 높아졌으며, 이후 AI 없는 시험에서도 뚜렷한 성적 하락이 나타나지 않았다. 주요 기업들이 답변 과정에 질문과 단계라는 의도적인 마찰을 넣는 이유다. 교육 AI의 경쟁 기준은 이제 답을 얼마나 빨리 내놓는지보다 사용자가 얼마나 오래 생각하고 자신의 근거로 결론에 도달하도록 돕는지에 맞춰지고 있다.