![AI 튜터가 학습 분야에서 인간 전문가의 1대1 지도와 비슷한 학습 효과를 냈다는 연구 결과가 나왔다. [사진: 챗GPT]](https://contents-cdn.viewus.co.kr/image/2026/09/CP-2023-0397/image-6202dc74-a7dd-4027-96a2-43f78335462a.jpeg)
[디지털투데이 AI리포터] AI 튜터가 미국 대학원 입학시험(GRE) 대비 학습에서 인간 전문가의 1대1 지도와 비슷한 효과를 냈다는 연구 결과가 나왔다. 특히 일부 AI 모델은 학습 효과 대비 비용이 인간 전문가의 900분의 1 수준에 불과했다.
지난 26일(현지시간) 일본 매체 기가진에 따르면 핸드셰이크 AI 리서치(Handshake AI Research) 연구팀은 성인 2383명을 대상으로 AI와 인간 전문가의 GRE 지도 효과를 비교했다. 참가자들은 수학 또는 언어 문제 27개를 푼 뒤 AI 13종 중 하나, 인간 전문가의 화상 지도, GRE와 무관한 교육 영상 시청 중 하나에 배정돼 1시간 동안 학습했다. 이후 같은 영역의 새로운 문제 27개를 풀었다.
수학과 언어를 합친 정답률 상승 폭은 AI 지도 2139회에서 평균 13.9%p(포인트), 인간 지도 140회에서 15.6%p, 영상 시청 190회에서 7.1%p였다. 사전 점수 등을 보정하면 AI와 인간의 차이는 0.58%p에 그쳤고, 90% 신뢰구간도 연구진이 미리 설정한 동등성 기준 ±4.09%p 안에 들어, AI와 인간 지도의 전체 학습 효과가 통계적으로 동등한 것으로 나타났다. 다만 수학에서는 동등성이 확인된 반면 언어에서는 인간 전문가의 효과가 더 컸다.
AI 모델별 성능 차이도 컸다. 수학과 언어에 공통으로 투입된 12종 가운데 6종만 인간 전문가와 통계적으로 동등한 효과를 냈다. 이 가운데 가장 저렴한 ‘Gemma 4 31B’의 1회 평균 추론 비용은 약 0.067달러(약 91원)였다.
연구진은 인간 전문가 비용을 시간당 75달러(약 10만1900원)로 가정하고 정답률 1%p 향상에 필요한 비용을 계산했다. Gemma 4 31B는 약 0.0052달러(약 7원), 인간 전문가는 4.81달러(약 6540원)로 AI가 약 918분의 1 수준이었다. 다만 이는 AI 추론 비용과 인간 지도료의 참고가격을 비교한 수치다.
연구진은 “이번 실험이 1시간 학습 직후의 효과만 측정한 만큼 장기간 학습 내용이 유지되는지는 추가 연구가 필요하다”라고 설명했다.















댓글0