2026.07.21 (화)

  • 흐림동두천 24.0℃
  • 구름많음강릉 23.6℃
  • 흐림서울 24.5℃
  • 맑음대전 26.9℃
  • 맑음대구 28.4℃
  • 맑음울산 26.1℃
  • 맑음광주 27.6℃
  • 맑음부산 26.4℃
  • 맑음고창 26.9℃
  • 맑음제주 28.3℃
  • 흐림강화 25.9℃
  • 맑음보은 24.3℃
  • 맑음금산 25.3℃
  • 맑음강진군 26.4℃
  • 맑음경주시 23.5℃
  • 맑음거제 26.4℃
기상청 제공

빅테크

[빅테크칼럼] “AI가 AI를 만든다”…앤트로픽의 경고가 의미하는 ‘재귀적 자기개선’의 문턱

 

[뉴스스페이스=김정영 기자] 미국 AI 스타트업 앤트로픽(Anthropic)이 “AI가 곧 자신의 후계자를 직접 설계·구축할 수 있는 단계, 이른바 재귀적 자기개선(recursive self‑improvement)에 근접하고 있다”고 공개 경고를 내놓으면서, 글로벌 AI 거버넌스 논쟁이 새로운 국면으로 접어들고 있다.

 

Claude가 쓰는 코드가 80%…개발 속도 8배 뛴 내부 데이터


앤트로픽 연구조직 ‘Anthropic Institute’의 마리나 파바로(Marina Favaro)와 공동창업자 잭 클라크(Jack Clark)는 6월 4일(현지시간) 공개한 블로그 ‘When AI builds itself’에서, 자사 내부 데이터를 근거로 “AI가 AI 개발을 가속하는 구조적 변곡점에 진입했다”고 주장했다.

 

이 글에 따르면 2026년 5월 기준 앤트로픽 프로덕션 코드베이스에 병합되는 코드의 80% 이상이 자사 모델 ‘클로드(Claude)’가 작성한 것으로, 2025년 2월 ‘Claude Code’ 출시 이전 한 자릿수 비중에서 급격히 뛰어올랐다.

 

개별 엔지니어의 개발 생산성도 눈에 띄게 변했다. 앤트로픽은 “평균 엔지니어가 하루에 병합하는 코드량이 2024년 대비 약 8배 수준으로 증가했다”고 밝혔다.

 

또한 내부 설문조사에서 연구원 130명을 대상으로 ‘AI 도구를 쓸 때와 사용하지 않을 때 생산성’을 물었더니, 중간값 기준 약 4배의 생산성 향상을 체감하고 있는 것으로 나타났다.

 

코드 양뿐 아니라 난도 높은 작업에서의 성공률도 가파르게 상승했다. 명확한 사양이 없는 오픈엔디드 엔지니어링 과제에서 클로드의 성공률은 6개월 사이 50%포인트 상승해 2026년 5월 76%에 도달했다는 설명이다.

 

AI 학습 코드 최적화 벤치마크에서는 2025년 5월 ‘Claude Opus 4’의 약 3배 속도 향상이 2026년 4월 ‘Claude Mythos Preview’에서는 약 52배 속도 향상으로 점프한 것으로 보고됐다.

 

“아직 재귀적 자기개선은 아니다”…그러나 ‘문턱’이 보이기 시작했다


앤트로픽은 이번 보고서에서 “우리는 아직 재귀적 자기개선 단계에 도달하지 않았고, 그것이 필연적인 것도 아니다”라고 선을 그으면서도, “그러나 그 시점이 대부분의 제도와 기관이 예상하는 것보다 더 빨리 올 수 있다는 징후가 포착되고 있다”고 강조했다.

 

보고서가 말하는 재귀적 자기개선은 “AI 시스템이 스스로 후속 모델을 설계·구현·훈련하고, 그 더 나은 후속 모델이 다시 후속 모델 개발을 가속하는 자기 증폭 루프”를 의미한다.

 

앤트로픽은 외부 데이터도 근거로 제시했다. 코드 문제 해결 벤치마크인 SWE‑bench에서 상위 모델들이 인간 수준 성능에 근접하고 있고, 비영리 연구단체 METR가 “AI가 한 번에 처리할 수 있는 작업 길이가 약 4개월마다 두 배씩 늘어나고 있다”고 분석한 결과를 함께 인용했다.

 

이는 인간 연구자가 담당하던 점점 더 긴·복잡한 작업 사슬을 AI가 통째로 떠안는 속도가 빨라지고 있음을 시사한다.

 

“단독 브레이크는 소용없다”…냉전식 arms‑control을 연상시키는 ‘글로벌 일시정지론’


흥미로운 점은, 앤트로픽이 이 같은 데이터에도 불구하고 ‘공격적 질주’가 아니라 ‘조건부 감속 옵션’을 공개 제안했다는 대목이다.

 

보고서는 “이 기술의 막대한 파급효과에 대비할 시간을 벌기 위해 개발 속도를 효과적으로 늦출 수 있다면, 그것은 바람직한 선택일 것”이라면서도, “그러나 특정 연구소가 일방적으로 속도를 늦추면, 단지 경쟁사에 주도권을 넘겨주는 결과가 될 것”이라고 적었다.

 

앤트로픽이 상정하는 해법은 ‘검증가능한 다자 조율’이다. 보고서는 “여러 국가에 위치한 복수의 프런티어 연구소가 동일 조건 아래 개발을 중단하기로 합의하고, 서로가 실제로 멈추었는지 검증할 수 있는 메커니즘”이 필요하다고 주장한다.

 

잭 클라크는 BBC 인터뷰에서 “가속 페달에서 발을 떼고 브레이크를 밟을 수 있는 옵션을 만들어야 한다”며, 이 검증 메커니즘 연구를 앤트로픽 연구소가 앞으로 중점 과제로 삼을 것이라고 밝혔다.

 

보고서는 이 조율·검증 문제를 냉전 시기 핵·군비통제 조약에 비유하면서도, “이번에는 신뢰를 구축하는 데 수십 년의 시간 여유가 없다”고 못박았다. AI 개발 속도가 과거 어느 기술보다 가파르게 진행되고 있다는 현실 인식이 반영된 표현이다.

 

오픈AI도 ‘재귀적 자기개선’ 전담 안전연구 인력 채용…연봉 최대 44만5000달러


앤트로픽의 블로그는 하루 전 공개된 오픈AI의 공공정책 어젠다와도 맞물린다. 오픈AI는 최근 발표한 문서에서 미국 연방정부에 “재귀적 자기개선으로의 진전을 우선적으로 모니터링할 것”과, 프런티어 AI 안전을 담당하는 ‘AI 표준 및 혁신 센터(Center for AI Standards and Innovation)’를 제도적 허브로 강화할 것을 제안했다.

 

인력 수급에서도 기류 변화가 감지된다. 오픈AI는 ‘Preparedness’ 안전팀 소속으로 재귀적 자기개선에 특화된 안전 연구원 채용 공고를 내고, 연간 29만5000~44만5000달러(총 보상)의 파격 조건을 제시했다.

 

비즈니스인사이더와 업계 매체에 따르면 이 직무는 “모델이 스스로 더 나은 버전을 훈련할 수 있게 될 때의 위험과 방어전략”을 연구하고, 데이터 중독(data poisoning) 방어, 모델 해석도구 개발, “기술 스태프 자동화 수준을 측정하는 지표 설계” 등을 맡게 된다.

 

이는 재귀적 자기개선을 단순한 ‘성능 목표’가 아니라, 사전에 대비해야 할 위험 시나리오로 규정하고 대응 인력을 확보하겠다는 신호로 읽힌다.

 

세 가지 시나리오…가장 가능성 큰 건 ‘인간이 주도권 유지하는 고생산성 시대’


앤트로픽은 AI 발전 경로에 대해 세 가지 시나리오를 제시했다. 첫째는 현재 수준에서 성능 향상이 둔화되거나 정체되는 경우, 둘째는 AI가 거대한 생산성 향상을 제공하되 인간이 여전히 개발과 통제를 주도하는 경우, 셋째는 AI가 스스로 후계 모델을 설계·훈련해 개발 속도가 사실상 컴퓨팅 자원에 의해만 결정되는 완전한 재귀적 자기개선 단계에 도달하는 경우다.

 

보고서는 “현재 증거상 가장 가능성이 큰 것은 두 번째 시나리오”라며, 당장 ‘슈퍼 인공지능의 폭주’보다는 “인간과 AI가 결합된 고생산성 체제에서의 거버넌스 과제”에 초점을 맞추는 것이 합리적이라고 평가했다.

 

그럼에도 앤트로픽과 오픈AI가 동시에 재귀적 자기개선을 공론장 한가운데로 끌어올린 것은, “아직 오지 않은 미래”에 대해 정책·규제·표준 체계를 미리 설계해야 한다는 위기감 때문이다.

 

자체 코드의 80%를 AI가 쓰고, 엔지니어 생산성이 8배로 뛴 조직이 “언제든 브레이크를 밟을 수 있는 제도적 옵션”을 요구하고 있다는 사실은, 기술사적 분기점이 생각보다 가까이 와 있음을 상징적으로 보여준다.

 

국내 정책당국과 산업계 역시 “얼마나 빨리 따라갈 것인가”를 넘어, “어디까지 허용하고 어디서 멈출 것인가”라는 더 근본적인 질문에 답을 준비해야 할 시점이다.

 

빅테크 전문가들은 "현재 한국 AI 기업들이 개발하고 있는 코드 어시스턴트·에이전트형 서비스가 어느 순간 다음 세대 AI 연구·개발까지 통째로 떠안는 구조로 미끄러져 들어갈 수 있다"면서 "이런 가능성을 앤트로픽의 내부 데이터가 적나라하게 보여주고 있다"고 강조했다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[이슈&논란] 미국, 삼성전자·SK하이닉스에 반도체 이익 배분 요구…"초과이익 나눠 갖자" 너도나도 숟가락 얹기

[뉴스스페이스=김정영 기자] 미국 정부가 삼성전자와 SK하이닉스를 향해 반도체 '초과이익'의 일부를 미국 측에 배분하라는 새로운 요구를 제기한 것으로 확인됐다. 코리아타임스는 18일(현지시간 기준) 업계 소식통을 인용해, 릭 스위처 미국 무역대표부(USTR) 부대표가 지난달 여한구 통상교섭본부장과의 회의에서 이같은 입장을 전달했다고 보도했다. 한국 정부의 한 고위 관계자도 미국 측이 실제로 이러한 주장을 했다고 별도로 확인했다. 논리의 뼈대는 2023년 초과이익 공유제 미국 측의 논거는 "미국 기업들이 한국산 반도체를 대량 구매함으로써 한국 기업의 수익 창출에 기여했으므로, 한국 하청업체가 수익 일부를 받는다면 미국 파트너도 마찬가지 자격이 있다"는 것이다. 이는 2023년 조 바이든 행정부가 반도체과학법(CHIPS Act) 보조금 지급 조건으로 도입한 '초과이익 공유제'와 궤를 같이한다. 당시 미 상무부는 1억5000만 달러 이상 보조금을 받는 기업이 예상보다 많은 수익을 낼 경우, 지원금의 최대 75%까지 미 정부와 나누도록 규정했다. 이번 요구는 보조금 수급 여부와 무관하게 '구매자'라는 지위만으로 이익 배분을 주장하는 것이어서, 과거보다 한층 확장된

[빅테크칼럼] "STEM 아는 자가 AI 10배 더 잘 쓴다"… 딥마인드 하사비스, 전 세계 학생들에게 던진 '경고장'

[뉴스스페이스=이종화 기자] 구글 딥마인드 CEO 데미스 하사비스(Demis Hassabis)가 AI 시대에도 STEM(과학·기술·공학·수학) 교육의 가치가 오히려 커지고 있다고 재차 강조하면서, 그의 발언이 전 세계 교육·산업계에 파장을 일으키고 있다. "10배 효과" 발언의 맥락 7월 14일(현지시간) 공개된 런던 비즈니스 콘퍼런스 인터뷰 영상에서 하사비스는 "깊은 기술적 이해를 갖춘 사람들은 그렇지 않은 사람들보다 AI 도구를 10배 더 효과적으로 활용할 수 있을 것"이라고 밝혔다. 그는 프로그래밍의 역사를 "기계어→C언어→파이썬으로 이어지는 진화 과정"으로 설명하며, "미래의 프로그래밍 언어는 영어 자체가 될 수도 있지만 아키텍처 설계와 소프트웨어 엔지니어링 모범 사례에 대한 이해는 여전히 필수"라고 못박았다. 이 같은 발언은 처음이 아니다. 하사비스는 지난해 6월 SXSW 런던 행사에서도 "지금 학생이라면 수학, 물리, 컴퓨터 과학 같은 STEM 과목을 공부하겠다"고 밝힌 바 있으며, 지난 9월 와이어드(Wired)와의 인터뷰에서는 "이런 도구에 네이티브한 사람들은 10배 더 생산적일 수 있다"고 언급하며 같은 논리를 반복해왔다. 특히 지난 4월 2

[빅테크칼럼] "질문언어에 따라 대답·성격 달랐다" 힌디어·아랍어 '공손·위로', 영어·러시아 '깐깐·엄밀', 한국어 '솔직·간결'…앤트로픽, AI 가치관의 언어편차 '실증'

[뉴스스페이스=이종화 기자] 앤트로픽(Anthropic)이 7월 13일(현지시간) 자사 챗봇 '클로드'가 사용 모델과 대화 언어에 따라 서로 다른 가치관을 드러낸다는 연구 결과를 공개했다. 전 세계 수백만 명이 이용하는 AI 시스템의 일관성과 편향성 문제를 정면으로 겨냥한 첫 대규모 실증 연구다. 31만 건 대화 해부한 4개 가치 축 앤트로픽 공식자료와 인디아투데이 보도에 따르면, 앤트로픽 사회적 영향(Societal Impacts) 팀은 2026년 5월 2주간 클로드.ai에서 수집된 실제 익명 대화 30만9,815건을 분석했다. 대상은 소넷 4.6, 오퍼스 4.6, 오퍼스 4.7 등 3개 모델과 한국어를 포함한 사용량 상위 20개 언어였으며, 기존에 파악된 3,000개 이상의 가치를 ▲수용성-신중함 ▲따뜻함-엄밀함 ▲깊이-간결함 ▲솔직함-실행력이라는 4개 해석 가능한 축으로 압축했다. 다만 이 4개 축이 실제 대화에서 나타난 가치 표현 차이를 설명하는 비율은 약 15%에 그쳐, 여전히 상당 부분이 미해명 상태로 남아 있다는 점은 눈여겨볼 대목이다. 힌디어·아랍어는 "위로형", 영어·러시아어는 "따박따박형" 가장 큰 변동폭을 보인 축은 '따뜻함 대 엄밀함'이