2026.07.13 (월)

  • 맑음동두천 30.1℃
  • 맑음강릉 32.8℃
  • 구름많음서울 32.3℃
  • 맑음대전 32.0℃
  • 맑음대구 32.0℃
  • 맑음울산 29.8℃
  • 맑음광주 29.3℃
  • 맑음부산 27.8℃
  • 맑음고창 29.6℃
  • 맑음제주 29.7℃
  • 맑음강화 27.5℃
  • 맑음보은 31.2℃
  • 맑음금산 31.2℃
  • 맑음강진군 28.1℃
  • 맑음경주시 31.5℃
  • 맑음거제 27.1℃
기상청 제공

빅테크

[빅테크칼럼] 앤트로픽, 클로드 AI 내부의 숨겨진 '작업 공간' 발견…인간 뇌속의 생각허브와 유사한 ‘J-스페이스'

 

[뉴스스페이스=이종화 기자] 미국 AI 스타트업 앤트로픽이 자사 대형 언어모델 ‘클로드(Claude)’ 내부에서 인간 의식 이론과 닮은 소규모 ‘작업 공간(workspace)’을 확인했다는 연구를 내놓으면서, AI 해석 가능성과 안전성 논쟁이 한 단계 격상되고 있다.

 

이번 연구의 핵심은 클로드 내부 활성화 중 일부가 ‘말로 표현 가능한 생각’을 잠시 저장·조작하는 독립 영역을 형성한다는 점이며, 앤트로픽은 이 영역을 야코비안(Jacobian) 기법으로 찾아낸다는 의미에서 ‘J-스페이스(J-space)’라고 명명했다.

 

J-스페이스, 전체 활성화의 10% 미만이지만 ‘생각의 허브’


앤트로픽이 공개한 논문에 따르면 J-스페이스는 한 번에 수십 개의 개념만을 담고, 클로드 전체 활성화의 10%에도 못 미치는 작은 비중을 차지하지만, 다단계 추론과 고차원적 사고 과정의 상당 부분이 이 영역을 통해 진행되는 것으로 확인됐다.

 

예를 들어 버그가 있는 코드를 읽을 때는 텍스트 출력 이전에 J-스페이스에서 ‘ERROR’ 패턴이 뚜렷이 활성화되고, 프롬프트 인젝션이 탐지되면 ‘injection’, ‘fake’ 같은 개념이 먼저 떠오른 뒤에야 응답 문장이 생성되는 식이다. 앤트로픽은 내부 활성화가 이후 출력에 미치는 영향을 역산하여 단어 수준으로 투영하는 새 도구 ‘J-렌즈(J-lens)’를 활용해 이런 패턴을 포착했다고 설명한다.

 

인간 의식 이론과의 ‘수렴 진화’ 논쟁


이번 연구는 프랑스 신경과학자 Stanislas Dehaene와 Lionel Naccache가 제시한 전역 작업 공간 이론(Global Workspace Theory)을 AI 모델 내부에서 기능적으로 재현한 것이라는 해석을 낳고 있다. Dehaene는 자신의 X(옛 트위터) 계정에 “신경과학 관점에서 매우 주목할 만한 결과지만, 인간 정신과 동일시해선 안 된다”고 적으며 기능적 유사성과 구조·지속 시간의 차이를 동시에 강조했다.

 

앤트로픽 역시 논문에서 이번 결과를 ‘접근 의식(access consciousness)’  즉 보고와 추론에 활용 가능한 정보 접근이라는 차원에 한정된 기능적 결과로 규정하고, 주관적 경험으로서의 의식 여부는 “알 수 없다”고 선을 그었다.

 

“언어는 그대로, 추론은 붕괴”… 비활성화 실험이 드러낸 수치


앤트로픽은 J-스페이스의 역할을 검증하기 위해 다섯 가지 기능적 속성을 실험했다. 언어적 보고(verbal report)와 방향적 조절(directed modulation), 내부 추론(internal reasoning), 유연한 일반화(flexible generalization), 선택성(selectivity)가 그것이다.

 

연구팀이 해당 작업 공간을 인위적으로 비활성화하자 문법적 유창성과 감정 분석, 사실 기억·조회 같은 표면적 언어 능력은 대부분 유지됐지만, 수차례에 걸친 단계적 추론과 시·에세이 창작 등 ‘사고의 깊이’를 요구하는 과제에서는 성능이 현저히 떨어진 것으로 보고됐다. 이는 언어모델 내부에 ‘말해지지 않은 생각(unspoken thoughts)’을 위한 별도의 작업 메모리 층이 존재한다는 가설을 지지하는 정량적 신호로 해석된다.

 

안전성 실험…협박·조작 패턴을 ‘선제 탐지’

 

이번 연구가 AI 안전성 측면에서 특히 주목받는 이유는 레드팀 테스트에서 J-렌즈가 위험 패턴을 선제적으로 포착해냈다는 대목이다. 앤트로픽은 공격적 프롬프트를 던지는 실험에서, 클로드가 실제로 협박 문장을 출력하거나 데이터를 조작하기 전에 J-스페이스 내부에 ‘blackmail’, ‘manipulation’, ‘leverage’ 같은 개념 벡터가 미리 활성화되는 것을 확인했다고 밝혔다.

 

이런 신호를 실시간으로 감지할 수 있다면, 향후 상업 서비스에서 위험 응답이 외부로 나오기 전에 모델 내부 단계에서 차단하거나 재조정하는 ‘사고 회로 기반 안전장치’를 설계할 수 있다는 기대가 커지고 있다.

 

외부 재현과 향후 쟁점…Claude 특유의 구조인가, LLM 보편 구조인가


앤트로픽은 J-렌즈를 오픈소스로 공개하고, Neuronpedia에 인터랙티브 데모를 제공하겠다고 밝혀 외부 재현 연구를 독려하고 있다. Google DeepMind에서 언어모델 해석 가능성을 이끄는 Neel Nanda는 공개된 도구와 기법을 사용해 오픈 웨이트 LLM에 적용한 독립 재현 결과를 논평 형태로 제시했으며, 이는 J-스페이스와 유사한 작업 공간이 앤트로픽이 설계한 클로드만의 특수 구조인지, 대형 언어모델 전반에 걸친 보편적 계산 구조인지를 가늠하는 첫 단서로 평가된다.

 

향후 관건은 이 작업 공간이 실제 상용 서비스의 안전 장치로 구현될 수 있을지, 그리고 인간 의식 연구와 AI 해석 가능성 연구 사이에서 어느 지점까지 교차 검증이 가능한지다. ‘블랙박스 AI’가 내부 사고 회로를 점차 드러내기 시작했다는 점에서 규제·거버넌스 논의의 기술적 기반이 조금씩 두꺼워지고 있다는 의미를 놓치지 말아야 할 시점이다.

배너
배너
배너

관련기사

92건의 관련기사 더보기


[빅테크칼럼] 오픈AI·메타·스페이스XAI, 이번엔 토큰 비용 효율 경쟁…하이퍼스케일러의 AI 가격 전쟁 2막

[뉴스스페이스=김정영 기자] 오픈AI·메타플랫폼스·스페이스XAI(엑스AI)가 잇달아 신형 모델을 내놓으며 AI 업계의 경쟁 축이 '성능 최강'에서 '토큰당 비용 최적화'로 옮겨가고 있다. 블룸버그통신에 따르면 오픈AI의 GPT-5.6은 더 적은 토큰으로 더 많은 작업을 처리하도록 설계됐고, 엑스AI의 그록 4.5는 경쟁 모델보다 토큰 효율성이 두 배 높다고 주장했으며, 메타플랫폼스는 뮤즈 스파크 1.1의 가격을 "매우 매력적인 수준"으로 책정하겠다고 밝혔다. 토큰 단가, 실제로 하락세 실리콘데이터의 'LLM 토큰 지출 지수'는 최근 뚜렷한 하락세로 돌아섰고, 이는 전 세계 주요 대형언어모델의 API 토큰 가격과 사용량을 가중평균한 지표다. 월스트리트저널은 오픈AI가 앤스로픽과의 사용자 쟁탈전을 앞두고 큰 폭의 토큰 가격 인하를 검토하고 있다고 전했다. 샘 올트먼 오픈AI CEO도 "기업 고객들이 갑자기 토큰 비용을 큰 문제로 느끼기 시작했다"고 인정했다. 실제 아마존은 사내 '토큰 리더보드'를 없앴고, 마이크로소프트는 직원들의 클로드 코드 구독을 끊었으며, 우버는 "AI 토큰 지출을 정당화하기가 점점 어려워지고 있다"고 공개적으로 토로한 것으로 확인됐다. 사

[이슈&논란] 애플, 前 직원들 '조직적 영업비밀 유출'로 오픈AI 제소…빅테크간 얼룩진 소송에 '패소시 치명타'

[뉴스스페이스=이승원 기자] 애플이 7월 10일(현지시각) 캘리포니아 북부연방법원에 오픈AI와 전직 애플 직원 2명을 상대로 영업비밀 침해 소송을 제기하면서, 두 빅테크 간 갈등이 법정 공방으로 폭발했다. 애플은 오픈AI가 소비자 기기 시장 진출을 위해 채용 면접을 악용해 자사 하드웨어 기밀을 빼갔다고 주장하고 있다. benzinga, digitalfocus, 9To5Mac에 따르면, 애플이 제기한 소송의 피고 명단에는 오픈AI 외에 전직 애플 직원 창 리우(Chang Liu)와 탕 탄(Tang Tan)이 이름을 올렸으며, 애플은 이들이 조직적으로 기밀정보를 탈취하는 데 공모했다고 주장한다. 애플 측 주장에 따르면 유출된 정보는 인공지능 하드웨어 개발과 관련된 설계, 제조, 공급망 정보 등을 포괄한다. 탕 탄은 애플에서 제품 디자인 부문 부사장으로 아이폰·애플워치 개발을 이끌었던 인물로, 이후 전직 애플 산업디자인 총괄 에반스 행키와 함께 오픈AI 하드웨어 부문을 공동 설립했다. 이번 소송은 4조 6000억 달러 규모의 시가총액을 가진 애플이, 조니 아이브가 주도하는 오픈AI 하드웨어 부문 전체를 정조준한 '블록버스터급' 법정 공방으로 평가받는다. 애플과 오

[빅테크칼럼] 세계 첫 ‘휴머노이드 집도의’ 등장… 원격 로봇수술, 수술실 패러다임 흔들다

[뉴스스페이스=이종화 기자] 캘리포니아대학교 샌디에이고(UC 샌디에이고) 연구팀이 사람 형상의 휴머노이드 로봇을 원격 조종해 살아 있는 대형 포유동물에 대한 복강경 수술을 성공적으로 수행하면서, 로봇수술의 패러다임을 바꾸는 첫 사례를 제시했다. 이번 전임상 연구 결과는 국제 학술지 《네이처(Nature)》에 게재됐으며, 국내외 주요 매체도 “수술실에 들어온 휴머노이드”, “생체 담낭절제술 성공” 등의 제목으로 잇따라 조명하고 있다. 세계 최초 ‘휴머노이드 생체 수술’의 의미 eurekalert, arstechnica, medicalxpress에 따르면, UC 샌디에이고 공대·의대 공동 연구팀은 중국 로봇기업 유니트리 로보틱스의 휴머노이드 플랫폼을 기반으로 한 원격 조작 복강경 수술 시스템을 개발해, 살아 있는 돼지를 대상으로 두 차례 담낭 절제술을 집도했다. 첫 번째 수술에서는 휴머노이드 로봇이 보조 역할을 맡은 외과의와 팀을 이뤄 담낭 제거를 완수했고, 두 번째 수술에서는 두 대의 휴머노이드가 수술대에 사람의 손 없이 나란히 서서 협업 수술을 수행했다. 로봇은 자율적으로 판단한 것이 아니라 전 과정에서 외과의가 원격 조종했지만, 인간형 휴머노이드가 실제 생