2026.07.19 (일)

  • 맑음동두천 22.2℃
  • 흐림강릉 21.6℃
  • 박무서울 23.2℃
  • 대전 23.1℃
  • 흐림대구 22.5℃
  • 흐림울산 23.3℃
  • 흐림광주 26.0℃
  • 박무부산 24.5℃
  • 흐림고창 23.2℃
  • 흐림제주 26.9℃
  • 구름많음강화 22.1℃
  • 흐림보은 23.8℃
  • 구름많음금산 23.6℃
  • 흐림강진군 26.1℃
  • 흐림경주시 22.7℃
  • 구름많음거제 26.9℃
기상청 제공

빅테크

[빅테크칼럼] AI 주식투자, 인간 애널리스트 위협하다…주식분석 미래 보여준 플로리다大 실험

 

[뉴스스페이스=이종화 기자] AI가 현직 금융 분석가들이 수행하는 상당수 업무를 대체할 수 있을 만큼 인상적인 성과를 보였다는 연구결과가 나왔다. 이 연구는 AI의 주식 분석 및 투자 전략 수립 능력이 인간 애널리스트의 역할을 근본적으로 재정의할 수 있음을 시사한다는 점에서 큰 충격을 줬다.

 

Morningstar, The Irish Times, Alpha Architect, CNBC 등의 외신 보도에 따르면, 플로리다대학교의 금융학 교수 알레한드로 로페즈-리라(Alejandro Lopez-Lira)가 챗GPT, 딥시크(DeepSeek), 그록(Grok) 등 최신 AI 모델의 주식 선정 능력을 실험한 결과, 높은 수익률과 함께 AI의 우수성이 입증됐다고 밝혔다.

 

주식투자에서 AI의 실전 성과와 한계


로페즈-리라는 2022년 오픈AI의 챗GPT 출시 직후부터 AI가 실제로 주식 시장에서 통할 수 있는지 실험을 시작했다. 초기에는 뉴스 헤드라인이 주가에 미치는 영향을 AI가 얼마나 정확히 해석할 수 있는지 테스트했고, 이 단순한 실험만으로도 놀라운 512%의 수익률을 기록했다.

 

이후 실제 투자 앱(Autopilot)과 연계해 거시경제, 지정학, 기업 재무 등 다양한 정보를 AI에 입력하고 포트폴리오를 구성하는 등 방법론을 고도화했다.

 

 

로페즈-리라는 "AI 모델이 실시간 데이터에 직접 접근하지 못하는 한계가 있지만, 이미 상당수 애널리스트 업무는 대체 가능하다"고 평가했다. 그는 "물리적 세계에서의 상호작용이나 대면 인터뷰를 제외하면, 대부분의 정보 분석 업무는 이미 대형 언어모델(LLM)로 자동화할 수 있다"고 밝혔다.

 

AI vs 인간, 주식투자 성과 비교


최근 다수의 연구와 실전 사례에서도 AI의 우수성이 입증되고 있다. 글로벌 AI 기반 투자 플랫폼 다니엘핀(Danelfin)은 2017년부터 2024년까지 +263%의 누적 수익률을 기록해 S&P 500(+189%)을 크게 상회했다. AI가 최고 점수를 매긴 종목은 3개월 기준 연환산 알파 +14.69%를 기록했고, 최저 점수 종목은 -37.38%로 저조했다.

 

또한, 시드니의 헤지펀드 미노투어 캐피탈(Minotaur Capital)은 애널리스트 없이 AI만으로 6개월간 13.7%의 수익률을 올려 글로벌 시장 평균(6.7%)을 두 배 이상 상회했다. 이 회사는 "AI는 훨씬 빠르고 저렴하게 리서치 업무를 수행할 수 있다"고 밝혔다.

 

학계 연구에서도 AI는 인간 애널리스트를 54.5%의 확률로 능가했다. 특히 방대한 데이터 처리와 패턴 인식에서 AI의 강점이 두드러진다. 다만, 소형주, 비유동주, 급변하는 산업 등에서는 인간의 경험과 직관이 여전히 중요한 경쟁력으로 남아 있다.

 

챗GPT vs 딥시크, 트레이딩 특성 비교


챗GPT는 복잡한 트레이딩 지침 처리, 경제 뉴스 해석, 펀더멘털 분석에서 강점을 보인다. 실제 테스트에서 514번의 거래와 33% 승률로 수익성 있는 전략을 구현했다. 챗GPT가 식별한 긍정적 뉴스는 6개월 후까지 시장 수익률과 상관관계를 보였다.

 

반면 딥시크는 수치 기반 데이터 분석, 알고리즘 트레이딩, 복잡한 수학적 계산에 강하다. 단순 전략 개발과 자동화에 유리하지만, 뉴스 등 비정형 데이터 해석력은 챗GPT에 비해 떨어진다. 딥시크가 포착한 정보는 즉시 가격에 반영돼 미래 예측력은 제한적이다.

 

증권업계 반응과 전망


알리바바의 조 차이(Chairman Joe Tsai)는 "AI가 애널리스트의 일상적 리서치 업무를 완전히 대체할 수 있다"고 평가하면서도, "최종 판단과 추천에는 인간의 주관적 판단이 여전히 필요하다"고 밝혔다. JP모건, BNY멜론 등 글로벌 금융사도 AI 도입으로 애널리스트의 업무 효율이 크게 높아질 것으로 내다봤다.

 

결국, AI의 등장은 인간 애널리스트의 역할을 근본적으로 변화시키고 있다. 데이터 처리와 반복 업무는 AI가 담당하고, 인간은 고차원의 해석과 전략적 의사결정에 집중하는 'Man + Machine' 협업 모델이 새로운 표준이 될 전망이다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[이슈&논란] 미국, 삼성전자·SK하이닉스에 반도체 이익 배분 요구…"초과이익 나눠 갖자" 너도나도 숟가락 얹기

[뉴스스페이스=김정영 기자] 미국 정부가 삼성전자와 SK하이닉스를 향해 반도체 '초과이익'의 일부를 미국 측에 배분하라는 새로운 요구를 제기한 것으로 확인됐다. 코리아타임스는 18일(현지시간 기준) 업계 소식통을 인용해, 릭 스위처 미국 무역대표부(USTR) 부대표가 지난달 여한구 통상교섭본부장과의 회의에서 이같은 입장을 전달했다고 보도했다. 한국 정부의 한 고위 관계자도 미국 측이 실제로 이러한 주장을 했다고 별도로 확인했다. 논리의 뼈대는 2023년 초과이익 공유제 미국 측의 논거는 "미국 기업들이 한국산 반도체를 대량 구매함으로써 한국 기업의 수익 창출에 기여했으므로, 한국 하청업체가 수익 일부를 받는다면 미국 파트너도 마찬가지 자격이 있다"는 것이다. 이는 2023년 조 바이든 행정부가 반도체과학법(CHIPS Act) 보조금 지급 조건으로 도입한 '초과이익 공유제'와 궤를 같이한다. 당시 미 상무부는 1억5000만 달러 이상 보조금을 받는 기업이 예상보다 많은 수익을 낼 경우, 지원금의 최대 75%까지 미 정부와 나누도록 규정했다. 이번 요구는 보조금 수급 여부와 무관하게 '구매자'라는 지위만으로 이익 배분을 주장하는 것이어서, 과거보다 한층 확장된

[빅테크칼럼] "STEM 아는 자가 AI 10배 더 잘 쓴다"… 딥마인드 하사비스, 전 세계 학생들에게 던진 '경고장'

[뉴스스페이스=이종화 기자] 구글 딥마인드 CEO 데미스 하사비스(Demis Hassabis)가 AI 시대에도 STEM(과학·기술·공학·수학) 교육의 가치가 오히려 커지고 있다고 재차 강조하면서, 그의 발언이 전 세계 교육·산업계에 파장을 일으키고 있다. "10배 효과" 발언의 맥락 7월 14일(현지시간) 공개된 런던 비즈니스 콘퍼런스 인터뷰 영상에서 하사비스는 "깊은 기술적 이해를 갖춘 사람들은 그렇지 않은 사람들보다 AI 도구를 10배 더 효과적으로 활용할 수 있을 것"이라고 밝혔다. 그는 프로그래밍의 역사를 "기계어→C언어→파이썬으로 이어지는 진화 과정"으로 설명하며, "미래의 프로그래밍 언어는 영어 자체가 될 수도 있지만 아키텍처 설계와 소프트웨어 엔지니어링 모범 사례에 대한 이해는 여전히 필수"라고 못박았다. 이 같은 발언은 처음이 아니다. 하사비스는 지난해 6월 SXSW 런던 행사에서도 "지금 학생이라면 수학, 물리, 컴퓨터 과학 같은 STEM 과목을 공부하겠다"고 밝힌 바 있으며, 지난 9월 와이어드(Wired)와의 인터뷰에서는 "이런 도구에 네이티브한 사람들은 10배 더 생산적일 수 있다"고 언급하며 같은 논리를 반복해왔다. 특히 지난 4월 2

[빅테크칼럼] "질문언어에 따라 대답·성격 달랐다" 힌디어·아랍어 '공손·위로', 영어·러시아 '깐깐·엄밀', 한국어 '솔직·간결'…앤트로픽, AI 가치관의 언어편차 '실증'

[뉴스스페이스=이종화 기자] 앤트로픽(Anthropic)이 7월 13일(현지시간) 자사 챗봇 '클로드'가 사용 모델과 대화 언어에 따라 서로 다른 가치관을 드러낸다는 연구 결과를 공개했다. 전 세계 수백만 명이 이용하는 AI 시스템의 일관성과 편향성 문제를 정면으로 겨냥한 첫 대규모 실증 연구다. 31만 건 대화 해부한 4개 가치 축 앤트로픽 공식자료와 인디아투데이 보도에 따르면, 앤트로픽 사회적 영향(Societal Impacts) 팀은 2026년 5월 2주간 클로드.ai에서 수집된 실제 익명 대화 30만9,815건을 분석했다. 대상은 소넷 4.6, 오퍼스 4.6, 오퍼스 4.7 등 3개 모델과 한국어를 포함한 사용량 상위 20개 언어였으며, 기존에 파악된 3,000개 이상의 가치를 ▲수용성-신중함 ▲따뜻함-엄밀함 ▲깊이-간결함 ▲솔직함-실행력이라는 4개 해석 가능한 축으로 압축했다. 다만 이 4개 축이 실제 대화에서 나타난 가치 표현 차이를 설명하는 비율은 약 15%에 그쳐, 여전히 상당 부분이 미해명 상태로 남아 있다는 점은 눈여겨볼 대목이다. 힌디어·아랍어는 "위로형", 영어·러시아어는 "따박따박형" 가장 큰 변동폭을 보인 축은 '따뜻함 대 엄밀함'이