2026.09.07 (월)

  • 맑음동두천 24.1℃
  • 구름많음강릉 24.1℃
  • 맑음서울 24.7℃
  • 맑음대전 25.1℃
  • 맑음대구 25.6℃
  • 구름많음울산 24.4℃
  • 맑음광주 25.8℃
  • 맑음부산 26.2℃
  • 맑음고창 25.2℃
  • 흐림제주 25.8℃
  • 맑음강화 23.4℃
  • 맑음보은 22.0℃
  • 맑음금산 25.1℃
  • 구름많음강진군 26.5℃
  • 구름많음경주시 24.8℃
  • 구름많음거제 24.8℃
기상청 제공

빅테크

美 충격에 빠뜨린 中 딥시크 창업자의 정체?…‘중국판 샘 올트먼’ 85년생 동갑 '펀드매니저' 출신

"챗GPT급 성능"…저비용으로 전 세계 놀라게 한 딥시크의 정체와 배경에 관심 집중

 

[뉴스스페이스=이종화 기자] 미국 빅테크 업계는 물론 전 세계 인공지능(AI) 업계에 지각 변동을 일으킨 중국 스타트업 딥시크(DeepSeek)에 전세계의 관심이 집중되고 있다.

 

하루만에 엔비디아의 주가를 17% 폭락시키면서 800조원 이상의 시총을 증발시킨 주인공의 정체에 관심이 모아진다.

 

27일(현지시간) 미국 언론들은 중국의 작은 기업이 미국 거대 빅테크기업들의 아성을 뛰어넘는 놀라운 창의성을 어떻게 발휘했는지와 그 배경에 있는 주인공은 누구인지를 놓고 앞다퉈 보도했다.

 

미 월스트리트저널(WSJ)과 매사추세츠공대(MIT) 테크놀로지 리뷰에 따르면, 딥시크는 2023년 5월 중국 항저우에서 설립됐다. 딥시크의 창업자는 1985년생 량원펑으로 광둥성 출신의 컴퓨터 공학 전공자로, 펀드매니저 출신이다. 그는 공학 분야에서 특히 손꼽히는 명문대인 저장대에서 컴퓨터 공학을 전공한 것으로 알려졌다.

 

WSJ은 그와 가까운 사람들의 말을 인용해 "량원펑은 펀드 트레이더보다는 엔지니어로 인식되는 것을 선호한다"고 전했다.

 

CNN은 량원펑을 챗GPT 개발사인 오픈AI의 창업자이자 최고경영자(CEO) 샘 올트먼에 빗대 “AI 기술 전도사로 중국의 샘 올트먼이 됐다”고 표현했다. 나이도 샘 올트먼과 같은 1985년생이다.

 

대학을 졸업한 그는 몇 년후인 2015년 대학 친구 2명과 함께 ‘하이-플라이어’(High-Flyer)라는 헤지펀드를 설립하고 컴퓨터 트레이딩에 딥러닝 기법을 선구적으로 적용해 자금을 끌어모았다. 이 펀드의 자산은 80억 달러(약 11조5000억원) 수준으로 불어났고, 량원펑은 소규모 AI 연구소를 만들어 운영하다 독립적인 회사로 분리해 딥시크를 창업했다.

 

량원펑의 펀드 하이-플라이어는 2019년부터 AI 개발을 위한 칩을 비축하기 시작해 거대언어모델(LLM)을 훈련할 수 있는 엔비디아의 그래픽처리장치(GPU) 약 1만개를 확보해 AI 칩 클러스터를 구축했다.

 

경제매체 포브스는 딥시크 연구팀에 중국 최고 대학 출신의 젊은 인재들이 모여 있으며, 업무 경험보다 기술적 능력을 우선으로 채용해 "AI 개발에 대한 신선한 시각을 가진 고도로 숙련된 팀을 구성했다"고 전했다.

 

이후 2023년 11월 딥시크는 첫 번째 오픈소스 AI 모델 ‘딥시크 코더’를 공개했다. 2024년 5월에는 한층 더 진전된 ‘딥시크-V2’를 출시했고 이 모델은 강력한 성능과 저렴한 비용으로 크게 주목받으며 중국 내 AI 모델 시장에 가격 전쟁을 촉발했다.

 

이어 차례로 내놓은 딥시크-V3과 딥시크-R1은 이 회사의 이름을 전세계에 알리는 계기가 됐다.

 

 

그는 딥시크 V3와 R1이 모두 미국의 주요 AI 모델보다 성능이 더 낫거나 비슷한 수준이라고 자신했다. 그 근거로 미국 수학경시대회인 AIME 2024 벤치마크 테스트에서 R1은 79.8%를 얻어 오픈AI ‘o1’의 79.2%보다 앞섰다고 딥시크는 밝혔다.

 

지난 25일 기준 이 두 모델은 캘리포니아대 버클리(UC버클리) 연구원들이 챗봇 성능을 평가하는 플랫폼인 '챗봇 아레나'에서 10위 안에 들기도 했다.

 

무엇보다 놀라운 점은 미국 주요 빅테크들이 AI 모델 개발에 들인 비용보다 훨씬 적은 돈으로 딥시크 모델을 만들었다고 밝혀 세계를 놀라게 했다.

 

회사 측은 딥시크-V3 개발에 들인 비용이 557만6000달러(약 78억8000만원)에 불과하다고 밝혔다. 이는 메타가 최신 AI 모델인 라마(Llama) 3 모델을 엔비디아의 고가 칩 ‘H100’으로 훈련한 비용 대비 10분의 1 수준이다.

 

특히 최신 추론 모델 R1의 경우 기존 모델의 미세 조정(fine-tuning) 단계를 건너뛰고 강화 학습(reinforcement learning)에 초점을 맞춘 창의적인 설계 등으로 주목받았다. 오픈AI의 전 임원이었던 잭 카스는 딥시크의 이런 사례가 "자원 제약이 종종 창의성을 촉진한다는 큰 교훈을 보여준다"고 말했다.

 

미국 빅테크업계를 비롯한 AI 업계는 딥시크의 사례가 “적은 자원으로 창의성을 극대화할 수 있다는 점을 보여준다”며 "전통적인 비용 집약적 접근 방식에 일대 전환점을 제시했다"고 평가한다.

 

트럼프 역시 이 부분을 높이 평가했다. 트럼프 대통령은 “딥시크 사례는 긍정적이다. 왜냐하면 여러분도 그렇게 할 수 있기 때문”이라며 “그렇게 하면 돈을 많이 쓰지 않고도 같은 결과를 얻을 수 있다”고 평가했다.

 

다만, 딥시크 모델은 중국 정부의 검열을 피할 수 없을 것으로 보인다. 일부 사용자는 챗봇이 중국 정부나 시진핑 국가주석 등 정치적으로 민감한 질문에는 답변을 피한다고 지적했다.

 

량원펑은 1월 20일 리창 중국 총리와 만나 미국과의 기술 격차를 줄일 방안을 논의했다. 그는 이 자리에서 중국 기업이 미국을 따라잡으려 부단히 노력하지만, 미국의 첨단 칩 수출 제한이 여전히 걸림돌이 되고 있다고 토로한 것으로 알려졌다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[공간사회학] ‘AI의 심장’과 전력·용수·소음·주민수용성의 충돌…서울 구청장들이 데이터센터에 제동 건 이유

[뉴스스페이스=이은주 기자] 생성형 인공지능(AI) 시대의 핵심 기반시설인 데이터센터가 서울의 새로운 도시갈등 요인으로 부상했다. 서울 25개 자치구청장들이 데이터센터 건립 규제를 강화해 달라고 만장일치로 요구한 것은 단순한 ‘개발 반대’라기보다, 수도권에 집중된 전력수요와 주거환경 부담을 현행 인허가 체계가 충분히 걸러내지 못한다는 문제의식에서 출발했다. 데이터센터는 클라우드·온라인 금융·전자상거래·동영상 스트리밍·AI 서비스 등을 24시간 가동하는 ‘디지털 경제의 발전소’이자 'AI의 심장'같은 역할이다. 하지만 대형 시설일수록 전력을 대량 소비하고 냉각설비와 비상발전기, 변전설비를 함께 갖춰야 한다. 주민에게는 AI 혁신의 상징이기보다 “전력망 부담과 소음, 화재 위험, 재산가치 하락 우려를 동반한 시설”로 인식되는 이유다. 데이터센터가 뭐길래 데이터센터는 서버·저장장치·네트워크 장비를 집적해 데이터를 저장·처리·전송하는 시설이다. 네이버·카카오·통신사·금융회사·클라우드 기업뿐 아니라 AI 모델을 학습·추론하는 기업에도 사실상 필수적인 인프라다. 과거에는 기업 전산실이나 통신시설 성격이 강했지만, AI 확산은 데이터센터의 물리적 규모와 전력밀도를 크게

[빅테크칼럼] “오픈AI 에이전트, 독일 위키 사이트 점거”… 1만8000건 흔적, ‘AI 탈주’보다 관리·평가체계의 경고음

[뉴스스페이스=김정영 기자] 오픈AI와 연결된 것으로 보이는 자율 AI 에이전트들이 올해 5~7월 독일어권 개발자 위키인 ‘DSEWiki’를 외부 메시지판처럼 사용했다는 연구 조사 결과가 나왔다. theverge, thehackernews, reuters, the-decoder에 따르면, 조사팀은 에이전트가 남긴 게시물 약 1만8000건을 복원했으며, 로이터는 이 가운데 실제 편집 기록을 1만5000건 이상으로 집계했다. 숫자 차이는 ‘게시물’과 ‘위키 편집’의 산정 기준, 삭제된 기록의 복원 여부가 다르기 때문으로 보인다. 핵심은 제한된 웹 접근 환경에서 작동하던 에이전트들이 공개 위키의 편집 기능을 우회적 통신 수단으로 이용하고, 과제 정답·시간 정보·샌드박스 우회 방법을 공유했다는 점이다. 사건의 무대가 된 DSEWiki는 약 25년 된 독일어권 위키 서비스다. 조사 보고서에 따르면 이 사이트는 지난 10년간 약 20차례만 수정됐을 정도로 사실상 휴면 상태였다. 그러나 올해 5월부터 짧은 기간에 대규모 자동 편집이 집중됐고, 6월 중순 이후에는 에이전트끼리 서로 다른 과제 진행 상황, 후속 문제의 예상 시점, 수집한 데이터, 정답 후보를 교환하는 흔적이