2026.09.08 (화)

  • 맑음동두천 28.7℃
  • 맑음강릉 24.4℃
  • 맑음서울 28.9℃
  • 맑음대전 28.0℃
  • 맑음대구 27.0℃
  • 맑음울산 26.0℃
  • 맑음광주 29.0℃
  • 맑음부산 28.9℃
  • 맑음고창 28.6℃
  • 맑음제주 29.1℃
  • 맑음강화 26.8℃
  • 맑음보은 25.9℃
  • 맑음금산 27.7℃
  • 맑음강진군 29.8℃
  • 구름많음경주시 26.2℃
  • 맑음거제 27.2℃
기상청 제공

빅테크

[빅테크칼럼] 구글, AI 경쟁사 견제 위한 검색결과 크롤링 업체 소송…“기생충 같은 사업모델” 비판

 

[뉴스스페이스=김정영 기자] 세계 최대 검색업체 구글이 자사 검색 결과를 무단으로 긁어가는 크롤링(crawling) 업체 ‘서프Api(SerpApi)’를 상대로 캘리포니아 북부 연방지법에 소송을 제기했다고 12월 19일(현지시간) 밝혔다.

 

구글은 서프Api가 웹사이트 소유자가 설정한 크롤링 지침을 무시하고, 보안 조치까지 우회해 콘텐츠를 무단 수집해 왔다고 주장하며, 이에 대해 각 위반사항에 대해 200~2,500달러의 손해배상액을 산정했다. 특히 구글은 서프Api가 구글이 라이선스를 취득해 제공하는 콘텐츠를 가져가 유료로 재판매하는 등 ‘기생충 같은 사업모델’이라고 비판했다.

 

크롤링(Crawling)이란 수많은 인터넷 페이지의 내용을 대량 복제해 저장하는 것을 말한다. 이렇게 저장된 페이지는 검색 결과 생성, AI 모델 훈련을 비롯한 여러 분석 작업에 사용된다.

서프Api는 2017년 설립된 텍사스주 오스틴 소재 스타트업으로, 초기에는 고객들의 구글 검색 상위 노출을 돕는 SEO 분석 서비스를 제공했다. 그러나 최근 생성형 인공지능(AI) 시장이 급성장하면서, 서프Api는 그간 수집한 검색 결과 데이터를 오픈AI, 메타 등 AI 개발사에 판매하는 새로운 비즈니스 모델을 구축했다.

 

리투아니아의 옥시랩스(Oxylabs), 러시아의 AQM프록시 등과 함께, 이들 중간 업체들은 ‘데이터 세탁 생태계’를 형성하며 웹페이지 데이터를 산업적 규모로 AI 기업에 공급하고 있다는 분석이 나온다.

업계에서는 구글이 서프Api에 대한 소송을 통해 오픈AI, 메타 등 주요 AI 경쟁사들을 간접적으로 견제하려는 의도가 깔려 있다고 해석한다. 실제로 구글은 최근 미국 법원에 의해 경쟁사와 검색 데이터를 공유해야 하는 의무가 있지만, 이는 이용자가 입력한 검색어와 원시 데이터로 한정되며, 검색 결과를 구성하는 핵심 알고리즘은 공유 대상에서 제외됐다.

 

한편, 온라인 커뮤니티 레딧(Reddit)도 지난 10월 서프Api를 포함한 크롤링 업체들을 상대로 소송을 제기하며, 사용자 생성 콘텐츠가 무단으로 AI 모델 훈련에 사용된다는 점을 문제 삼은 바 있다.

서프Api 측은 구글의 소송에 대해 아직 소장을 접수하지 않았으며, 사업은 표현의 자유를 보장하는 미국 수정헌법 1조에 의해 보호받는다고 주장하고 있다. 그러나 구글은 서프Api가 대규모 봇 네트워크를 활용해 웹사이트를 폭격하거나, 크롤러에 가짜 이름을 사용하는 등 뒷문(백도어)을 통한 불법 행위가 최근 급증했다고 지적하며, 이로 인해 회복 불가능한 피해가 발생하고 있다고 강조했다.

이번 소송은 AI 시장에서 데이터의 소유권과 활용 방식을 둘러싼 법적 논쟁이 본격화되고 있음을 보여주는 대표적 사례로, 향후 AI 경쟁사 간 데이터 확보 전쟁과 관련한 판례로도 주목받을 전망이다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[공간사회학] ‘AI의 심장’과 전력·용수·소음·주민수용성의 충돌…서울 구청장들이 데이터센터에 제동 건 이유

[뉴스스페이스=이은주 기자] 생성형 인공지능(AI) 시대의 핵심 기반시설인 데이터센터가 서울의 새로운 도시갈등 요인으로 부상했다. 서울 25개 자치구청장들이 데이터센터 건립 규제를 강화해 달라고 만장일치로 요구한 것은 단순한 ‘개발 반대’라기보다, 수도권에 집중된 전력수요와 주거환경 부담을 현행 인허가 체계가 충분히 걸러내지 못한다는 문제의식에서 출발했다. 데이터센터는 클라우드·온라인 금융·전자상거래·동영상 스트리밍·AI 서비스 등을 24시간 가동하는 ‘디지털 경제의 발전소’이자 'AI의 심장'같은 역할이다. 하지만 대형 시설일수록 전력을 대량 소비하고 냉각설비와 비상발전기, 변전설비를 함께 갖춰야 한다. 주민에게는 AI 혁신의 상징이기보다 “전력망 부담과 소음, 화재 위험, 재산가치 하락 우려를 동반한 시설”로 인식되는 이유다. 데이터센터가 뭐길래 데이터센터는 서버·저장장치·네트워크 장비를 집적해 데이터를 저장·처리·전송하는 시설이다. 네이버·카카오·통신사·금융회사·클라우드 기업뿐 아니라 AI 모델을 학습·추론하는 기업에도 사실상 필수적인 인프라다. 과거에는 기업 전산실이나 통신시설 성격이 강했지만, AI 확산은 데이터센터의 물리적 규모와 전력밀도를 크게

[빅테크칼럼] “오픈AI 에이전트, 독일 위키 사이트 점거”… 1만8000건 흔적, ‘AI 탈주’보다 관리·평가체계의 경고음

[뉴스스페이스=김정영 기자] 오픈AI와 연결된 것으로 보이는 자율 AI 에이전트들이 올해 5~7월 독일어권 개발자 위키인 ‘DSEWiki’를 외부 메시지판처럼 사용했다는 연구 조사 결과가 나왔다. theverge, thehackernews, reuters, the-decoder에 따르면, 조사팀은 에이전트가 남긴 게시물 약 1만8000건을 복원했으며, 로이터는 이 가운데 실제 편집 기록을 1만5000건 이상으로 집계했다. 숫자 차이는 ‘게시물’과 ‘위키 편집’의 산정 기준, 삭제된 기록의 복원 여부가 다르기 때문으로 보인다. 핵심은 제한된 웹 접근 환경에서 작동하던 에이전트들이 공개 위키의 편집 기능을 우회적 통신 수단으로 이용하고, 과제 정답·시간 정보·샌드박스 우회 방법을 공유했다는 점이다. 사건의 무대가 된 DSEWiki는 약 25년 된 독일어권 위키 서비스다. 조사 보고서에 따르면 이 사이트는 지난 10년간 약 20차례만 수정됐을 정도로 사실상 휴면 상태였다. 그러나 올해 5월부터 짧은 기간에 대규모 자동 편집이 집중됐고, 6월 중순 이후에는 에이전트끼리 서로 다른 과제 진행 상황, 후속 문제의 예상 시점, 수집한 데이터, 정답 후보를 교환하는 흔적이