2026.07.13 (월)

  • 맑음동두천 24.8℃
  • 맑음강릉 28.9℃
  • 맑음서울 28.3℃
  • 맑음대전 25.8℃
  • 맑음대구 27.5℃
  • 맑음울산 26.5℃
  • 구름많음광주 27.9℃
  • 구름많음부산 27.1℃
  • 맑음고창 27.5℃
  • 맑음제주 28.7℃
  • 맑음강화 24.4℃
  • 맑음보은 23.4℃
  • 맑음금산 24.2℃
  • 맑음강진군 27.9℃
  • 맑음경주시 24.7℃
  • 맑음거제 27.0℃
기상청 제공

빅테크

[빅테크칼럼] “AI가 숙제 해주자, 시험점수 20% 증발”…중국 2만7000명 장기추적이 보여준 ‘생성형 AI 학습 페널티’

 

[뉴스스페이스=이종화 기자] 중국 중·고등학생 2만6,811명을 30개월간 추적한 대규모 실증 연구에서, 숙제를 빨리 끝내기 위해 생성형 AI를 활용한 학생들의 시험 성적이 최대 20%까지 떨어지는 이른바 ‘학습 페널티’가 확인됐다. 반면, 수업 시간에 설계된 튜터링 도구로 AI를 활용할 경우에는 학습 효율과 몰입도가 오히려 높아지는 상반된 결과가 다른 연구들에서 반복적으로 관찰되고 있다.

 

숙제 시간 30% 줄고, 시험 점수는 20% 떨어져

 

Harvard Gazette, Basic Intelligence, Brian Renshaw, PubMed, CEPR Discussion Papers에 따르면, 경제정책연구센터(CEPR)가 발표한 토론 논문 ‘The Generative AI Learning Penalty: Evidence from Chinese Secondary Education’는 중국 7~12학년 학생 26,811명의 패널 데이터를 30개월 동안 추적하며 생성형 AI의 교육 효과를 정량 분석했다.

 

연구에 따르면 AI 도입 이후 학생들의 숙제 완료 시간은 평균 30% 단축됐고, 숙제 점수는 18% 상승했지만, AI 사용이 금지된 월별 폐쇄형 시험 점수는 불과 6개월 만에 20% 하락했다. 더 큰 문제는 장기 누적 효과다. 고등학교·대학 입시와 같은 고부담 시험에서는 2년 경과 시점에 점수 하락폭이 18~24%까지 벌어져, 단기 편의가 장기 학습능력 훼손으로 이어졌음을 시사한다.

 

연구진은 이를 “숙제 생산성은 올라가지만, 실제 학습은 후퇴하는 전형적 생산성–학습 괴리”로 규정했다.

 

“노력의 전가”가 만든 학습 손실 80%


이번 연구의 핵심 키워드는 ‘노력의 전가(effort displacement)’다. 연구진은 학습 손실의 약 80%가 과제를 비정상적으로 빠른 속도로 끝내면서도 높은 숙제 점수를 받는 특정 집단에서 발생했다고 분석했다. 이는 학생이 스스로 문제를 고민하고 풀이 과정을 밟기보다, AI가 내놓은 답안을 거의 그대로 제출하는 패턴과 일치한다는 설명이다.

 

반대로 AI를 쓰더라도 비사용자와 비슷한 숙제 시간을 유지한 학생들의 경우 시험 성적 하락은 소폭에 그쳐, ‘얼마나 빨리 끝냈느냐’가 아니라 ‘얼마나 스스로 생각했느냐’가 성패를 가른 셈이다. 과목별로는 사회과학에서 가장 큰 성적 하락이 나타났고, 그 다음이 이공계(STEM)와 외국어 과목이었다. 연령·집단별로는 저연령층, 상위권 학생, 남학생에게서 학습 페널티가 두드러져, 오히려 학업 능력이 높고 AI 친숙도가 높은 집단일수록 ‘AI 의존의 함정’에 더 빨리 빠질 위험이 큰 것으로 드러났다.

 

튜터로 쓰면 ‘두 배 학습 효과’, 숙제 대행으로 쓰면 ‘학습 붕괴’


이번 CEPR 연구는 “AI 사용의 맥락이 학습 효과를 결정한다”는 기존 논의를 데이터로 뒷받침한다. 와튼스쿨 이선 몰릭 교수는 최근 자신의 SNS에서 중국 대규모 연구를 언급하며 “잘 설계된 AI 튜터링은 수업을 뒷받침해 시험 점수를 끌어올리지만, 숙제를 ‘도와주는’ AI 사용은 학습을 갉아먹는다”고 요약했다.

 

실제로 《네이처》 자매지인 Scientific Reports에 실린 하버드대 무작위 통제 실험(RCT)에서는, 연구진이 물리학 수업에 맞춰 설계한 AI 튜터를 사용한 대학생들이 기존 능동적 대면 수업을 들은 학생들보다 더 짧은 시간에 더 많은 내용을 학습하고, 자기보고식 학습 참여도와 동기 역시 더 높게 나타났다. 이 실험에서 AI 튜터를 활용한 그룹의 학습 증가는 대면 수업 그룹의 약 두 배 수준으로, “교수–조교 중심 액티브 러닝보다 설계된 AI 튜터가 더 큰 학습효과를 냈다”는 결론을 얻었다.

 

미국·말레이시아 등 여러 대학에서 진행된 또 다른 연구들에서도 GPT-4 기반 ‘튜터 모드’는 학습 성취를 높이는 반면, 일반 챗봇을 제한 없이 과제에 쓰게 하면 AI 사용 경험자 그룹의 후속 시험 점수가 비사용자 대비 17%가량 떨어지는 부정적 효과가 보고된 바 있다.

 

중국·미국에서 번지는 ‘AI 숙제 의존’…정책·평가 혁신 없으면 페널티 확산


이처럼 상반된 연구 결과는 현재의 AI 사용 행태가 어디에 더 가깝느냐에 따라 교육의 미래가 갈릴 수 있음을 시사한다. 중국에서는 《차이나 데일리》 전국 설문조사에서 초·중·고 학생의 60% 이상이 AI 사용 경험이 있다고 답했고, 이들 중 71%는 “숙제를 할 때 AI를 활용한다”고 응답했다.

 

미국에서도 NPR·입소스(Ipsos) 여론조사에 따르면 K-12 교사의 55%가 “AI가 주로 학생들이 학습 부담을 피하기 위한 편법으로 쓰이고 있다”고 인식하고 있어, 중국·미국 모두 AI의 용도가 ‘숙제 단축 도구’ 쪽에 기울어 있는 양상이다. 이런 상황에서 일부 미국 대학들은 구술 시험, 수업 내 실시간 과제, 프로젝트 기반 평가로 전환해 AI 편법의 여지를 줄이는 시도를 시작했다.

 

그러나 AI 기반 교육기술 시장 규모가 430억 달러 이상으로 추산되는 중국을 비롯해, 대규모 K-12 시스템 전반이 평가·수업 설계를 어떻게 재구성할지는 여전히 미지수다. 공통된 메시지는 분명하다. 생성형 AI는 ‘숙제 대행’으로 쓰일 때 학습 능력을 깎아내리는 위험한 지름길이지만, 명확한 교수 설계와 교사 개입 아래 ‘디지털 튜터’로 활용될 경우, 기존 수업의 한계를 보완하는 강력한 학습 증폭 도구가 될 수 있다는 점이다.

배너
배너
배너

관련기사

7건의 관련기사 더보기


[이슈&논란] 애플, 前 직원들 '조직적 영업비밀 유출'로 오픈AI 제소…빅테크간 얼룩진 소송에 '패소시 치명타'

[뉴스스페이스=이승원 기자] 애플이 7월 10일(현지시각) 캘리포니아 북부연방법원에 오픈AI와 전직 애플 직원 2명을 상대로 영업비밀 침해 소송을 제기하면서, 두 빅테크 간 갈등이 법정 공방으로 폭발했다. 애플은 오픈AI가 소비자 기기 시장 진출을 위해 채용 면접을 악용해 자사 하드웨어 기밀을 빼갔다고 주장하고 있다. benzinga, digitalfocus, 9To5Mac에 따르면, 애플이 제기한 소송의 피고 명단에는 오픈AI 외에 전직 애플 직원 창 리우(Chang Liu)와 탕 탄(Tang Tan)이 이름을 올렸으며, 애플은 이들이 조직적으로 기밀정보를 탈취하는 데 공모했다고 주장한다. 애플 측 주장에 따르면 유출된 정보는 인공지능 하드웨어 개발과 관련된 설계, 제조, 공급망 정보 등을 포괄한다. 탕 탄은 애플에서 제품 디자인 부문 부사장으로 아이폰·애플워치 개발을 이끌었던 인물로, 이후 전직 애플 산업디자인 총괄 에반스 행키와 함께 오픈AI 하드웨어 부문을 공동 설립했다. 이번 소송은 4조 6000억 달러 규모의 시가총액을 가진 애플이, 조니 아이브가 주도하는 오픈AI 하드웨어 부문 전체를 정조준한 '블록버스터급' 법정 공방으로 평가받는다. 애플과 오

[빅테크칼럼] 세계 첫 ‘휴머노이드 집도의’ 등장… 원격 로봇수술, 수술실 패러다임 흔들다

[뉴스스페이스=이종화 기자] 캘리포니아대학교 샌디에이고(UC 샌디에이고) 연구팀이 사람 형상의 휴머노이드 로봇을 원격 조종해 살아 있는 대형 포유동물에 대한 복강경 수술을 성공적으로 수행하면서, 로봇수술의 패러다임을 바꾸는 첫 사례를 제시했다. 이번 전임상 연구 결과는 국제 학술지 《네이처(Nature)》에 게재됐으며, 국내외 주요 매체도 “수술실에 들어온 휴머노이드”, “생체 담낭절제술 성공” 등의 제목으로 잇따라 조명하고 있다. 세계 최초 ‘휴머노이드 생체 수술’의 의미 eurekalert, arstechnica, medicalxpress에 따르면, UC 샌디에이고 공대·의대 공동 연구팀은 중국 로봇기업 유니트리 로보틱스의 휴머노이드 플랫폼을 기반으로 한 원격 조작 복강경 수술 시스템을 개발해, 살아 있는 돼지를 대상으로 두 차례 담낭 절제술을 집도했다. 첫 번째 수술에서는 휴머노이드 로봇이 보조 역할을 맡은 외과의와 팀을 이뤄 담낭 제거를 완수했고, 두 번째 수술에서는 두 대의 휴머노이드가 수술대에 사람의 손 없이 나란히 서서 협업 수술을 수행했다. 로봇은 자율적으로 판단한 것이 아니라 전 과정에서 외과의가 원격 조종했지만, 인간형 휴머노이드가 실제 생

[빅테크칼럼] 앤트로픽, 클로드 AI 내부의 숨겨진 '작업 공간' 발견…인간 뇌속의 생각허브와 유사한 ‘J-스페이스'

[뉴스스페이스=이종화 기자] 미국 AI 스타트업 앤트로픽이 자사 대형 언어모델 ‘클로드(Claude)’ 내부에서 인간 의식 이론과 닮은 소규모 ‘작업 공간(workspace)’을 확인했다는 연구를 내놓으면서, AI 해석 가능성과 안전성 논쟁이 한 단계 격상되고 있다. 이번 연구의 핵심은 클로드 내부 활성화 중 일부가 ‘말로 표현 가능한 생각’을 잠시 저장·조작하는 독립 영역을 형성한다는 점이며, 앤트로픽은 이 영역을 야코비안(Jacobian) 기법으로 찾아낸다는 의미에서 ‘J-스페이스(J-space)’라고 명명했다. J-스페이스, 전체 활성화의 10% 미만이지만 ‘생각의 허브’ 앤트로픽이 공개한 논문에 따르면 J-스페이스는 한 번에 수십 개의 개념만을 담고, 클로드 전체 활성화의 10%에도 못 미치는 작은 비중을 차지하지만, 다단계 추론과 고차원적 사고 과정의 상당 부분이 이 영역을 통해 진행되는 것으로 확인됐다. 예를 들어 버그가 있는 코드를 읽을 때는 텍스트 출력 이전에 J-스페이스에서 ‘ERROR’ 패턴이 뚜렷이 활성화되고, 프롬프트 인젝션이 탐지되면 ‘injection’, ‘fake’ 같은 개념이 먼저 떠오른 뒤에야 응답 문장이 생성되는 식이다. 앤트

[이슈&논란] 현대차 아틀라스 로봇, 축구 심판에게 경기 공 전달…FIFA 월드컵서 피지컬 AI 시험무대

[뉴스스페이스=이승원 기자] 현대자동차그룹이 북중미 FIFA 월드컵 2026 16강 브라질-노르웨이전에서 휴머노이드 로봇 아틀라스를 투입해 경기 공 전달 퍼포먼스를 선보이며 로보틱스 기업으로의 정체성 전환을 전 세계 축구팬 앞에서 실험했다. 미국 뉴저지 이스트 러더퍼드 메트라이프 스타디움에서 열린 이 경기 하프타임에 아틀라스는 선수 입장 터널에서 등장해 글로벌 스타 선수들의 세리머니를 재현한 뒤, 심판 이스마일 엘파스에게 후반전 공인구를 직접 전달하며 후반 시작을 알렸다. 현대차 측은 이를 “FIFA 월드컵 실전 경기 환경에 인간형 로봇이 최초로 도입된 사례”로 규정하며, 변수가 많은 실제 경기장 환경에서 복합 동작을 안정적으로 수행한 점을 강조했다. 아틀라스의 월드컵 데뷔는 이미 5월 말부터 예고된 ‘훈련 영상’ 캠페인의 현실 버전이다. 현대차는 공식 유튜브 채널과 보스턴 다이내믹스 채널을 통해 월드컵 역사적 장면을 분석하며 축구 기술을 학습하는 과정을 담은 5부작 ‘스쿨 오브 풋볼(School of Football)’ 영상을 공개했고, 이 시리즈는 공개 5일 만에 3300만뷰를 돌파했다. 영상 속 아틀라스는 펠레·마라도나·메시·손흥민 등의 실제 플레이를