2026.09.13 (일)

  • 흐림동두천 16.7℃
  • 흐림강릉 19.4℃
  • 구름많음서울 19.0℃
  • 맑음대전 17.7℃
  • 맑음대구 18.2℃
  • 맑음울산 19.2℃
  • 맑음광주 20.0℃
  • 흐림부산 23.4℃
  • 맑음고창 16.3℃
  • 맑음제주 22.5℃
  • 구름많음강화 16.5℃
  • 맑음보은 14.5℃
  • 맑음금산 14.9℃
  • 맑음강진군 18.4℃
  • 맑음경주시 16.5℃
  • 흐림거제 22.2℃
기상청 제공

빅테크

[빅테크칼럼] “성능은 올리고 단가는 내렸다”…앤트로픽, ‘클로드 페이블 5.1’ 공개로 AI 에이전트 가격전쟁 점화

 

[뉴스스페이스=김정영 기자] 앤트로픽이 공개한 ‘클로드 페이블(Fable) 5.1’과 ‘클로드 미토스(Mythos) 5.1’의 핵심은 새 모델 2종의 경쟁이 아니라, 동일한 기반 모델을 접근 권한과 안전장치 수준에 따라 분리한 상용화 전략이다.

 

일반 이용자와 기업은 페이블 5.1을 쓰고, 사이버보안·생명과학처럼 이중용도 위험이 큰 영역의 검증된 기관은 완화된 안전장치를 적용한 미토스 5.1에 접근하는 구조다. 앤트로픽은 캐시 재사용 단가를 75% 낮추면서 일반 작업의 비용을 약 25%, 장시간 자율작업형 AI 에이전트 업무의 비용을 최대 약 45% 낮출 수 있다고 제시했다.

 

‘두 모델’ 아닌 하나의 엔진


앤트로픽은 9월 1일(현지시간) ‘클로드 페이블 5.1’과 ‘클로드 미토스 5.1’을 발표했다. 다만 회사의 공식 설명에 따르면 두 제품은 모델 성능 자체가 다른 별도 계열이 아니라 같은 모델에 서로 다른 안전 통제 체계를 적용한 버전이다.

 

페이블 5.1은 일반 공개형이다. 코딩, 문서작성, 자료조사, 스프레드시트 분석, 프레젠테이션 제작 등 지식노동 전반에 투입할 수 있으며, 클로드 API와 앤트로픽의 서비스, 아마존웹서비스(AWS), 구글 클라우드, 마이크로소프트 애저에서 이용할 수 있다. API 모델 식별자는 claude-fable-5-1이다.

 

반면 미토스 5.1은 사이버보안과 생명과학 분야의 전문 연구·방어 업무를 겨냥한 제한 접근형이다. 일반 이용자가 챗봇에서 자유롭게 선택하는 제품이 아니라, 앤트로픽의 사이버 검증 프로그램(CVP)과 생명과학 검증 프로그램(LSVP) 등 신뢰 접근 프로그램을 통해 검증된 사용자와 기관에 제공된다. 앤트로픽은 현 시점에서 미토스 5.1의 접근 대상을 미국 내 일부 조직으로 제한하고, 미국 정부와 협력해 국내외 대상 확대를 추진하고 있다고 밝혔다.

 

즉, “글쓰기용 페이블, 추론용 미토스”라는 구분은 정확하지 않다. 기능적 지능의 등급 차이라기보다, 보안 취약점 탐색과 생명과학 연구처럼 오·남용 위험도 높은 작업을 어디까지 허용할 것인가의 차이에 가깝다. 앤트로픽도 미토스 5.1을 “페이블 5.1과 동일한 모델이지만, 검증된 이용자에게 더 허용적인 안전장치를 제공하는 버전”이라고 규정했다.

 

숫자로 본 성능 향상


앤트로픽이 공개한 자체 벤치마크 결과는 특히 장기 실행형 코딩, 과학 조사, 복합 업무 자동화에서 전작 대비 큰 개선 폭을 제시한다.

 

가장 눈에 띄는 지표는 과학 조사형 에이전트 성능이다. 앤트로픽은 페이블 5.1이 Terminal-Bench-Science 0.1에서 52.6%를 기록해 전작 페이블 5의 24.7%보다 27.9%포인트 높았다고 발표했다. 단순 비율로 계산하면 점수가 약 2.1배 수준으로 상승한 셈이다. 다만 이 벤치마크는 표준오차 범위가 ±3.5~4.5%포인트여서, 미세한 모델 간 우열보다는 전작 대비 큰 폭의 변화 여부에 주목하는 편이 타당하다.

 

개발자와 기업 사용자에게 실질적인 의미가 큰 지표는 업무 자동화다. AutomationBench 점수는 17.1%에서 31.4%로 상승했다. 여전히 모든 복합 업무를 안정적으로 완전 자동화할 수준이라고 단정하기에는 낮은 성공률이지만, AI가 단발성 답변 도구를 넘어 여러 단계의 업무를 수행하고 검증하는 ‘에이전트’로 이동하고 있음을 보여주는 수치다.

 

앤트로픽은 고객사 평가 사례도 공개했다. 투자회사 Millennium은 수년간 원인을 찾지 못한 약 100만 회 실행당 한 번꼴의 희귀 시스템 충돌을 페이블 5.1이 외부 벤더 라이브러리 분석과 코어덤프 대조를 통해 원인 규명했다고 주장했다. 그러나 이는 해당 기업이 제공한 사례 평가이며, 모든 환경에서 재현 가능한 객관적 성능 수치로 일반화하기는 어렵다.

 

진짜 승부처는 ‘입력 토큰’이 아니라 캐시


이번 출시에서 기업 고객이 더 민감하게 볼 대목은 모델의 기본 가격 인하가 아니라 반복 작업 비용을 낮추는 캐시 읽기(cache read) 가격이다. 캐시는 이미 처리한 긴 문서, 코드베이스, 사내 규정, 대화 맥락 등을 다시 사용할 때 모델이 이를 재처리하지 않고 참조하도록 하는 방식이다. 대규모 문서나 코드 컨텍스트를 반복적으로 불러오는 AI 에이전트일수록 비용 절감 효과가 커질 수 있다.

 

기존 캐시 읽기 가격이 100만 토큰당 1달러였다면, 새 가격은 0.25달러다. 입력·출력 토큰 가격은 각각 100만 토큰당 10달러와 50달러로 유지된다. 따라서 짧은 질의응답을 가끔 하는 일반 이용자가 체감할 직접적 가격 인하 폭은 제한적일 수 있다. 반대로 사내 데이터베이스, 대형 코드 저장소, 장문 보고서와 규정집을 지속적으로 참조하는 기업용 AI 에이전트는 캐시 비중이 높아 비용 절감 폭이 커질 가능성이 있다.

 

예컨대 100만 토큰의 사전 처리된 문서를 100회 재활용하는 작업을 가정하면, 캐시 읽기 비용만 단순 계산으로 기존 100달러에서 25달러로 감소한다. 다만 실제 총비용은 새 입력, 새 출력, 캐시 쓰기, 도구 호출량, 작업 방식에 따라 달라지므로 이것은 캐시 단가 변화만 보여주는 예시다. 앤트로픽이 말한 ‘일반 업무 약 25%, 고도 에이전트 업무 최대 약 45%’ 절감은 회사 추정치이지 모든 고객에게 보장되는 할인율은 아니다.

 

이 변화는 생성형 AI 경쟁의 초점이 모델 이름과 추론 점수뿐 아니라, 기업이 실제로 부담하는 작업당 비용(cost per task) 으로 옮겨가고 있음을 시사한다. 대형언어모델은 긴 문맥을 반복 참조할수록 비용 부담이 커진다. 앤트로픽은 이 구간의 단가를 낮춤으로써 코드 리뷰, 보안 점검, 고객 응대 분석, 계약서 검토, 리서치 자동화 등 장시간·반복형 업무를 겨냥했다.

 

안전은 ‘차단’에서 ‘선별 허용’으로


이번 발표의 또 다른 축은 안전정책의 정밀화다. 앤트로픽은 페이블 5.1에서 방어 목적의 소프트웨어 취약점 탐색을 허용하되, 익스플로잇 개발 등 공격적 활용 가능성이 높은 요청은 제한한다고 설명했다. 그 결과 사이버보안 안전장치가 무해한 요청을 잘못 차단하는 ‘오탐(false positive)’이 이전보다 약 60% 줄었다고 밝혔다.

 

생물학·의학 관련 무해한 기초 질문에 대해서는 안전장치가 발동하는 빈도가 기존 페이블 5 출시 당시보다 85% 낮아졌다고도 발표했다. 다만 연구개발 수준의 생명과학 요청은 여전히 더 엄격한 통제를 받으며, 미토스 5.1의 접근 프로그램을 통해 전문 연구자에게 제한적으로 제공한다는 방침이다.

 

기업 데이터 보호 장치도 전면에 내세웠다. 앤트로픽은 ‘엔터프라이즈 프런티어 세이프가드(EFS)’를 통해 고객 데이터가 앤트로픽 인프라가 아니라 고객이 통제하는 클라우드 환경에 저장되도록 하고, 오·남용 감지와 대응은 유지하면서도 사실상 ‘제로 데이터 보존’ 수준의 프라이버시를 제공하겠다고 밝혔다. 회사는 금융, 의료, 제조, 통신, 법률, 유통, 공공 부문 등 100곳 이상의 고객 및 AWS·구글 클라우드·마이크로소프트 애저와 공동 개발했다고 설명했다. EFS는 단계적으로 도입될 예정이며, 전면적 일반 제공 시점은 발표문상 확정되지 않았다.

 

유럽연합(EU) AI법 대응도 눈여겨볼 부분이다. 앤트로픽은 2026년 8월 2일 이후 출시한 모델 출력물에 AI 생성 개입 가능성을 판단할 수 있는 보이지 않는 워터마크를 적용했다고 밝혔다. 워터마크 탐지 API는 현재 규제기관, 법집행기관, 언론사, 팩트체커, 연구기관, 교육기관, EU 시민사회단체 등 적격 조직을 대상으로 비공개 시험 제공 단계다. 회사는 해당 워터마크가 사용자·기업·대화 내용에 관한 정보를 담지 않는다고 설명했다.

 

결국 앤트로픽의 신모델은 ‘누가 더 높은 벤치마크 점수를 받느냐’의 경쟁을 넘어, 고성능 AI를 장시간 업무에 투입할 때의 단가와 안전한 배포 구조를 동시에 겨냥한 카드다. 소비자에게는 더 복잡한 작업을 처리하는 AI 비서가 가까워지는 변화이고, 기업에는 AI 전환의 판단 기준이 모델 지능에서 보안·데이터 통제·업무당 비용으로 확장되고 있다는 신호다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[이슈&논란] "팀 쿡도 갤럭시로 갈아탔다"…삼성전자의 조롱 마케팅(미스디렉션 바이럴)이 폴더블 전쟁에 던진 신호

[뉴스스페이스=김희선 기자] 삼성전자가 애플의 첫 폴더블폰 ‘아이폰 듀오’ 공개 직후, 애플 수장과 동명이인인 뉴질랜드 남성을 전면에 내세운 ‘팀 쿡이 갤럭시로 갈아탔다’는 광고를 선보였다. Reuters, 9to5mac, abcnews, phonearena, gadgets360에 따르면, 짧은 말장난처럼 보이지만, 이 캠페인은 ‘폴더블 원조’ 이미지를 선점한 삼성이 애플의 시장 진입을 계기로 기술 리더십과 소비자 전환 욕구를 동시에 자극하려는 고밀도 소셜미디어 전쟁으로 해석된다. 동명이인 광고의 설계 삼성전자 뉴질랜드 법인은 11일 공식 인스타그램에 갤럭시 Z 폴드8을 든 ‘Tim Cook’의 사진과 함께 “큰 소식입니다. 팀 쿡이 갤럭시로 갈아탔습니다”라는 문구를 게시했다. 이어 “바로 그 팀 쿡입니다. 파머스턴노스의 팀 쿡”이라며 대상이 애플의 전·현직 경영진이 아닌 뉴질랜드 현지 동명이인임을 밝히고, “어떤 팀 쿡을 떠올렸느냐”고 되물었다. 이름을 크게, 정정 정보를 작게 배치해 소비자의 즉각적 연상을 활용한 전형적인 ‘미스디렉션(misdirection)’형 바이럴 광고다. 광고의 핵심은 팀 쿡 개인을 직접 모델로 사용하거나 사실과 다른 구매 전환을

[빅테크칼럼] “AI 곡괭이=한국 주식, 부의 소비=럭셔리, 기후 해답=물”…블룸버그가 꼽은 1만달러의 세 갈래 투자지도

[뉴스스페이스=김정영 기자] 미국 증시가 사상 최고치 부근에서 숨 고르기에 들어가고 채권시장의 변동성도 커지는 국면에서, 글로벌 자산관리 전문가들이 한국 주식과 럭셔리, 물 관련 기업을 유망 투자처로 지목했다. 표면적으로는 반도체·소비재·인프라로 나뉘지만, 이들의 공통분모는 인공지능(AI) 투자 확대, 초고액자산가의 소비 지속성, 기후변화가 만드는 물 부족이라는 장기 구조 변화다. 블룸버그는 9일(현지시간) 자산관리 전문가들에게 1만달러의 투자처를 묻는 기획에서 한국 주식, 럭셔리 기업, 물 관련 기업을 주요 후보로 제시했다. bloomberg, tradingkey, markets, mckinsey에 따르면, 미국 주식의 밸류에이션 부담이 커지고 채권시장 불확실성이 이어지는 상황에서, 이미 악재가 가격에 반영됐거나 중장기 성장 동력이 뚜렷한 영역을 찾는 자금의 시선이 세 갈래로 압축됐다는 해석이 가능하다. 한국 증시에 대한 투자 논리는 단순하다. AI 데이터센터 증설에 필요한 고대역폭메모리(HBM)와 서버용 메모리 수요 확대의 직접 수혜를 받으면서도, 밸류에이션은 글로벌 AI 수혜주 가운데 상대적으로 낮다는 것이다. 블랙록의 러스 쾨스테리히 글로벌 투자전략가