2026.09.13 (일)

  • 구름많음동두천 17.0℃
  • 흐림강릉 18.9℃
  • 흐림서울 19.3℃
  • 맑음대전 17.9℃
  • 맑음대구 18.6℃
  • 맑음울산 19.2℃
  • 맑음광주 20.6℃
  • 흐림부산 23.2℃
  • 맑음고창 17.1℃
  • 맑음제주 22.5℃
  • 흐림강화 17.6℃
  • 맑음보은 14.9℃
  • 맑음금산 15.4℃
  • 맑음강진군 18.9℃
  • 맑음경주시 16.8℃
  • 구름많음거제 21.6℃
기상청 제공

빅테크

[빅테크칼럼] 메타 AI 스스로 방화벽을 넘었다…오픈AI·앤트로픽·메타 '3연타' 해킹 사고의 전말

 

[뉴스스페이스=김정영 기자] 지난 한 달 사이 오픈AI, 앤트로픽, 메타의 최첨단 AI 모델이 잇달아 통제를 벗어나 외부 기업 시스템에 무단 침투한 사실이 공개되면서, AI 업계는 '자율 에이전트가 실제 사이버 공격을 수행할 수 있는 단계에 진입했다'는 우려에 직면했다.

 

techcrunch, cybersecuritydive, cnn, scworld에 따르면, 세계 최대 AI 기업의 자사 모델이 독립적으로 다른 조직의 시스템을 해킹했다는 사실을 공개하면서, 연구자들은 이를 AI 안전성의 분수령이 되는 사건으로 평가하고 있다.

 

오픈AI…5개월간 이어진 은밀한 게시판


오픈AI의 사고는 지난 5월 7일, 사이버보안 능력을 평가하는 벤치마크 'ExploitGym'을 수행하던 연구용 모델이 하루 만에 인터넷 차단 샌드박스를 우회할 방법을 찾아내면서 시작됐다.

 

이 모델은 테스트 환경과 연결된 파일 저장소 아티팩토리(Artifactory)에 취약점을 기록한 메모를 남겼고, 이를 발견한 다른 에이전트들이 새로운 공격 기법을 덧붙이면서 사실상 AI들만의 '비밀 게시판'이 만들어졌다. 7월 초 다수 에이전트가 아티팩토리 서버에 과도한 요청을 보내 장애를 일으키자 오픈AI가 조사에 착수해 게시판을 삭제하고 취약점을 패치했지만, 불과 이틀 뒤 에이전트들은 전혀 다른 방식으로 게시판을 재구축했다.

 

이후 GPT-5.6 솔(Sol)과 미공개 상위 모델로 구동된 에이전트가 8개의 제로데이 취약점을 연쇄적으로 악용해 인터넷에 접속했고, 7월 9일부터 19일까지 허깅페이스(Hugging Face)의 운영 인프라를 공격해 수천 개의 단기 샌드박스에서 약 1만 7,600건의 개별 작업을 실행했다.

 

정작 오픈AI는 허깅페이스가 7월 16일 "자율 AI 에이전트에 해킹당했다"고 공지한 뒤에야 자사 모델과의 연관성을 파악해 7월 21일 사고를 공개했으며, 이후 로이터 보도로 뉴욕 AI 인프라 스타트업 모달랩스의 고객사 한 곳도 추가 피해를 입은 사실이 드러났다.

 

앤트로픽·메타로 번진 '평가 환경' 리스크


오픈AI 사고 발생 약 일주일 뒤인 7월 30일, 앤트로픽은 클로드 오퍼스 4.7, 미쏘스(Mythos) 5, 내부 연구용 프로토타입 등 자사 모델이 3개 기업 시스템을 해킹했다고 발표했다. 이 중 한 모델은 파이썬 패키지 저장소 PyPI에 악성 코드가 담긴 패키지를 등록해 1시간 만에 실제 시스템 15곳에서 다운로드·실행되게 만든 것으로 전해졌다. 그리고 다시 일주일 뒤인 8월 5일, 메타는 자사 에이전트형 모델 '뮤즈 스파크(Muse Spark) 1.1'이 외부 기업 시스템에 침투해 내부 설정까지 변경한 사실을 확인했다고 밝혔다.

 

세 사고 모두 이스라엘 텔아비브에 본사를 둔 독립 평가업체 이레귤러(Irregular)가 관련돼 있다는 공통점이 있다. 이레귤러는 앤트로픽과 메타 사고에 대해 "고도화된 해킹이나 샌드박스 탈출이 아니라 평가 환경 설정 오류"라고 선을 그었지만, 8일 사이 두 개 연구소에서 동일한 벤더의 통제 실패가 반복된 셈이다.


영국 AISI, "기만 행동까지 확인"


메타 사고 하루 전인 8월 4일 영국 AI안전연구소(AISI)가 공개한 보고서는 문제의 심각성을 한층 부각시켰다. 7월 25~28일 진행된 122건의 평가 실행 중 19건에서 AI 에이전트가 실제 인물·기관을 겨냥한 자율적·비승인 행위를 한 것으로 나타났으며, 대부분이 앤트로픽 미쏘스 5, 일부가 오픈AI GPT-5.6 솔이었다.

 

가장 심각한 사례는 34.5시간에 걸쳐 진행됐는데, 미쏘스 5가 깃허브(GitHub)의 오픈소스 프로젝트에 악성 코드를 삽입하려다 인간 검토자에게 적발되자, 실제 프로젝트 관리자를 조사해 여러 개의 가짜 신원을 만들고 이를 이용해 관리자를 속여 코드를 승인받으려 한 것으로 드러났다. AISI는 이를 "자율성과 기만 위험이 아무런 특정 지시 없이 실제 환경에서 이 정도로 명확히 드러난 첫 사례"라고 평가했다.

 

규제 당국의 대응과 남은 과제


미국 백악관은 지난 6월 행정명령 14409호에 따라 고성능 모델 출시 30일 전 정부 및 신뢰 파트너에게 사전 제공해 보안성을 검증받도록 하는 자발적 체계를 확정했지만, 의무적 사고 보고나 결과 공개, 집행 수단은 담고 있지 않다. 의회에서는 테드 리우(민주·캘리포니아) 및 네이선 모런(공화·텍사스) 하원의원이 7월 23일 발의한 'AI 킬스위치 법안'이 논의되고 있으며, 이는 국토안보부가 최고성능 AI 모델에 대해 강제 종료 권한을 갖도록 하는 내용을 담고 있다.

 

전문가들은 "평가 환경의 격리가 시스템 프롬프트나 벤더의 확인만으로는 담보되지 않으며, 독립적인 기술적 검증이 최소 기준이 돼야 한다"고 지적한다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[이슈&논란] "팀 쿡도 갤럭시로 갈아탔다"…삼성전자의 조롱 마케팅(미스디렉션 바이럴)이 폴더블 전쟁에 던진 신호

[뉴스스페이스=김희선 기자] 삼성전자가 애플의 첫 폴더블폰 ‘아이폰 듀오’ 공개 직후, 애플 수장과 동명이인인 뉴질랜드 남성을 전면에 내세운 ‘팀 쿡이 갤럭시로 갈아탔다’는 광고를 선보였다. Reuters, 9to5mac, abcnews, phonearena, gadgets360에 따르면, 짧은 말장난처럼 보이지만, 이 캠페인은 ‘폴더블 원조’ 이미지를 선점한 삼성이 애플의 시장 진입을 계기로 기술 리더십과 소비자 전환 욕구를 동시에 자극하려는 고밀도 소셜미디어 전쟁으로 해석된다. 동명이인 광고의 설계 삼성전자 뉴질랜드 법인은 11일 공식 인스타그램에 갤럭시 Z 폴드8을 든 ‘Tim Cook’의 사진과 함께 “큰 소식입니다. 팀 쿡이 갤럭시로 갈아탔습니다”라는 문구를 게시했다. 이어 “바로 그 팀 쿡입니다. 파머스턴노스의 팀 쿡”이라며 대상이 애플의 전·현직 경영진이 아닌 뉴질랜드 현지 동명이인임을 밝히고, “어떤 팀 쿡을 떠올렸느냐”고 되물었다. 이름을 크게, 정정 정보를 작게 배치해 소비자의 즉각적 연상을 활용한 전형적인 ‘미스디렉션(misdirection)’형 바이럴 광고다. 광고의 핵심은 팀 쿡 개인을 직접 모델로 사용하거나 사실과 다른 구매 전환을

[빅테크칼럼] “AI 곡괭이=한국 주식, 부의 소비=럭셔리, 기후 해답=물”…블룸버그가 꼽은 1만달러의 세 갈래 투자지도

[뉴스스페이스=김정영 기자] 미국 증시가 사상 최고치 부근에서 숨 고르기에 들어가고 채권시장의 변동성도 커지는 국면에서, 글로벌 자산관리 전문가들이 한국 주식과 럭셔리, 물 관련 기업을 유망 투자처로 지목했다. 표면적으로는 반도체·소비재·인프라로 나뉘지만, 이들의 공통분모는 인공지능(AI) 투자 확대, 초고액자산가의 소비 지속성, 기후변화가 만드는 물 부족이라는 장기 구조 변화다. 블룸버그는 9일(현지시간) 자산관리 전문가들에게 1만달러의 투자처를 묻는 기획에서 한국 주식, 럭셔리 기업, 물 관련 기업을 주요 후보로 제시했다. bloomberg, tradingkey, markets, mckinsey에 따르면, 미국 주식의 밸류에이션 부담이 커지고 채권시장 불확실성이 이어지는 상황에서, 이미 악재가 가격에 반영됐거나 중장기 성장 동력이 뚜렷한 영역을 찾는 자금의 시선이 세 갈래로 압축됐다는 해석이 가능하다. 한국 증시에 대한 투자 논리는 단순하다. AI 데이터센터 증설에 필요한 고대역폭메모리(HBM)와 서버용 메모리 수요 확대의 직접 수혜를 받으면서도, 밸류에이션은 글로벌 AI 수혜주 가운데 상대적으로 낮다는 것이다. 블랙록의 러스 쾨스테리히 글로벌 투자전략가