2026.09.03 (목)

  • 맑음동두천 25.5℃
  • 구름많음강릉 24.0℃
  • 맑음서울 28.5℃
  • 구름많음대전 26.6℃
  • 구름많음대구 25.2℃
  • 흐림울산 24.8℃
  • 흐림광주 28.7℃
  • 흐림부산 26.5℃
  • 흐림고창 27.1℃
  • 구름많음제주 29.0℃
  • 맑음강화 25.7℃
  • 구름많음보은 25.0℃
  • 구름많음금산 26.8℃
  • 흐림강진군 28.1℃
  • 흐림경주시 24.7℃
  • 흐림거제 26.8℃
기상청 제공

빅테크

[빅테크칼럼] '제미나이3' 성능 역전에 위기감 올트먼 '코드 레드' 발동…'챗GPT 올인' 비상경영 선언

 

[뉴스스페이스=이종화 기자] 구글이 최근 출시한 차세대 인공지능(AI) 모델 '제미나이3'의 압도적인 성능과 급속한 이용자 증가에 힘입어 글로벌 AI 경쟁 구도가 다시 한 번 요동치고 있다.

 

WSJ, 구글 공식 블로그, DataCamp, 9to5Google에 따르면, 샘 올트먼 오픈AI 최고경영자(CEO)는 내부적으로 '코드 레드'를 발령하며 챗GPT 성능 개선에 전사적 역량을 집중하고, 광고·쇼핑·건강 AI 에이전트 등 신규 수익화 사업은 일정을 연기하는 등 위기 대응에 나섰다.

 

제미나이3, 벤치마크서 오픈AI·앤트로픽 압도


제미나이3는 최근 공개된 AI 벤치마크에서 기존의 GPT-5.1(OpenAI), 클로드 소넷 4.5(Anthropic)를 모두 제치며 선두에 올랐다. 특히, AI 사고·추론 능력을 측정하는 '휴머니티스 라스트 이그잼'(Humanity’s Last Exam) 평가에서 제미나이3는 37.5%를 기록해 GPT-5.1(26.5%), 클로드 소넷 4.5(13.7%)를 크게 앞섰다.

 

수학적 추론을 평가하는 AIME 2025 벤치마크에서는 코드 실행 없이 95.0%의 높은 점수를 기록, GPT-5.1(88.0%)과 클로드 소넷 4.5(87.0%)를 앞섰으며, 복잡한 수학 문제 해결에서도 제미나이3가 23.4%로 가장 높은 성능을 보였다. 이는 AI 모델의 기초 추론 능력이 구글이 선도하고 있다는 평가를 낳았다.​

 

벤치마크 외적 성능, 응답 속도·멀티모달 등에서도 우위

 

제미나이3는 MMLU(다학제적 질문)에서 90%의 정확도를 기록, GPT-5.1과 클로드 소넷 4.5(각각 85%, 82%)를 상회했다. 특히, 대용량 문서 처리나 복잡한 데이터 분석 등 실무적인 과제에서 제미나이3는 GPT-5.1보다 2배 이상 빠른 속도를 보였으며, 104만 토큰의 초장문 입력 처리도 가능해 기업 및 연구기관의 활용도가 크게 높아졌다. 멀티모달(이미지·음성·동영상) 처리에서도 제미나이3가 영상 이해, 장문 문서 처리 등에서 경쟁 모델을 압도하는 성능을 보였다.​

 

이용자 급증, 구글 AI 플랫폼 위상 상승


제미나이3 출시 이후 구글 AI 플랫폼의 월간 활성 이용자(MAU)는 2025년 7월 4억5000만명에서 10월 6억5000만명으로 급증했다. 구글에 따르면 10월 기준 데스크톱 이용자는 1억400만명, 모바일 이용자는 1억200만명으로, 전년 동기 대비 2배 이상 증가했다. 이는 챗GPT(추정 8억명)와 견주어도 상승세가 매우 빠르며, AI 보조 도구 시장에서 구글의 입지가 강화되고 있음을 보여준다.​

 

오픈AI, 코드 레드 발동과 신사업 연기


이러한 상황 속에서 오픈AI는 챗GPT의 개인화, 응답 속도, 안정성, 처리 범위 등 전반적인 성능을 끌어올리기 위해 '코드 레드' 체제를 발동했다. 광고·쇼핑·건강 AI 에이전트, 맞춤형 리포트 생성(펄스) 등 신규 사업 프로젝트는 일정이 뒷순위로 밀렸다. 오픈AI는 조만간 제미나이3보다 높은 성능을 보이는 새로운 추론 모델을 공개할 계획이며, 내부 평가에서 경쟁 모델을 앞서는 점수를 목표로 하고 있다.

 

AI 시장, '성능-수익' 경쟁 본격화

 

AI 모델의 성능이 곧 시장 점유율과 수익화로 직결되는 시대가 본격화되고 있다. 구글은 제미나이3를 통해 기업 및 소비자 시장에서의 영향력을 확대하며, 오픈AI는 기존 챗GPT의 성장세와 최첨단 AI 연구 우위를 바탕으로 재정적 압박을 완화하려 하고 있다.

 

빅테크 업계 관계자들은 "AI 모델의 성능 경쟁이 단순한 기술적 우위를 넘어, 실제 비즈니스 수익화와 직결되는 경쟁으로 진화하고 있다"고 평가했다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[빅테크칼럼] 피차이 "AI, 5년 내 연구실 벗어나 일상 업무로 확산될 것"…알파벳의 2000억달러 인프라 승부수

[뉴스스페이스=김정영 기자] 순다르 피차이 알파벳 최고경영자(CEO)가 “향후 5년 안에 인공지능(AI)은 연구실과 얼리어답터의 영역을 벗어나 의료·행정·농업·개발·창업 현장의 일상적 업무 도구가 될 것”이라고 전망했다. 알파벳이 2026년 설비투자(Capex) 가이던스를 최대 2,050억달러로 끌어올린 배경은 단순한 데이터센터 증설이 아니라, AI를 전 산업의 업무 인프라로 전환시키겠다는 장기 베팅으로 읽힌다. 피차이의 ‘5년’은 제품 보급의 시간표 ad-hoc-news,indiantelevision,reuters, cnbc에 따르면, 피차이는 IIT 카라그푸르 75주년 기념 영상 메시지에서 “앞으로 5년을 바라보면 AI가 연구실과 얼리어답터로부터 멀어져, 실제로 일을 하는 사람들의 손으로 들어갈 것”이라고 말했다. 그가 구체적으로 열거한 대상은 의료 종사자, 정부 공무원, 농민, 개발자, 기업가다. 이는 AI의 경쟁 축이 대규모 언어모델(LLM)의 성능 시연에서 벗어나, 산업별 업무 흐름에 얼마나 깊이 들어가 생산성과 의사결정을 바꿀 수 있느냐로 이동할 것이라는 선언에 가깝다. 알파벳의 관점에서 이는 검색·유튜브·워크스페이스·안드로이드·구글 클라우드에 흩

[빅테크칼럼] “성능은 올리고 단가는 내렸다”…앤트로픽, ‘클로드 페이블 5.1’ 공개로 AI 에이전트 가격전쟁 점화

[뉴스스페이스=김정영 기자] 앤트로픽이 공개한 ‘클로드 페이블(Fable) 5.1’과 ‘클로드 미토스(Mythos) 5.1’의 핵심은 새 모델 2종의 경쟁이 아니라, 동일한 기반 모델을 접근 권한과 안전장치 수준에 따라 분리한 상용화 전략이다. 일반 이용자와 기업은 페이블 5.1을 쓰고, 사이버보안·생명과학처럼 이중용도 위험이 큰 영역의 검증된 기관은 완화된 안전장치를 적용한 미토스 5.1에 접근하는 구조다. 앤트로픽은 캐시 재사용 단가를 75% 낮추면서 일반 작업의 비용을 약 25%, 장시간 자율작업형 AI 에이전트 업무의 비용을 최대 약 45% 낮출 수 있다고 제시했다. ‘두 모델’ 아닌 하나의 엔진 앤트로픽은 9월 1일(현지시간) ‘클로드 페이블 5.1’과 ‘클로드 미토스 5.1’을 발표했다. 다만 회사의 공식 설명에 따르면 두 제품은 모델 성능 자체가 다른 별도 계열이 아니라 같은 모델에 서로 다른 안전 통제 체계를 적용한 버전이다. 페이블 5.1은 일반 공개형이다. 코딩, 문서작성, 자료조사, 스프레드시트 분석, 프레젠테이션 제작 등 지식노동 전반에 투입할 수 있으며, 클로드 API와 앤트로픽의 서비스, 아마존웹서비스(AWS), 구글 클라우드, 마이