전체기사 최신뉴스 GAM
KYD 디데이
산업 중기·벤처

속보

더보기

베일벗은 네이버 '초거대 AI'...구글·MS 대항마 될까

기사입력 : 2023년08월25일 14:24

최종수정 : 2023년08월25일 16:08

'1조 투자' 초거대 AI '하이퍼클로바X' 전격 출시
글로벌 빅테크와 경쟁 본격화…생성형 AI 춘추전국시대
"자체기술 탑재 후 환각 현상 72% 감소"

[서울=뉴스핌] 배요한 기자 = 네이버가 3년 동안 1조원을 투자해 개발한 초거대 인공지능(AI) 모델 '하이퍼클로바X'가 베일을 벗었다. 마이크로소프트, 구글 등 글로벌 빅테크들과의 AI 경쟁도 본격화 됐다. 

25일 업계에 따르면 전날 네이버는 팀네이버 컨퍼런스 '단 23'을 개최하고 초대규모 AI '하이퍼클로바'를 개발한 이후 2년 만에 업그레이드 모델 '하이퍼클로바X'를 공개했다.

이날 컨퍼런스에서 네이버는 하이퍼클로바X를 적용한 세 가지의 서비스를 소개했다. 대화형 AI 서비스인 '클로바X(CLOVA X)', 기업 생산성 향상을 위한 AI 플랫폼 '프로젝트 커넥트X(Project CONNECT X)' 그리고 비즈니스에 최적화된 AI 개발도구 '클로바 스튜디오(CLOVA Studio)'다.

네이버 관계자는 "20년 이상 축적된 데이터 자산을 활용해 한국 최적의 생성형 AI 모델을 구현했다"며 "기존 사업인 검색, 커머스, 광고, 클라우드, 웹툰 등 콘텐츠 사업 전반에 적용함으로써 소비자와 셀러, 개발자, 기업 모두의 편의성 및 업무효율성을 향상시킬 수 있다"고 밝혔다.

최수연 네이버 대표이사가 24일 그랜드 인터컨티넨탈 서울 파르나스에서 열린 팀네이버 컨퍼런스 'DAN 23'에서 차세대 생성형 AI인 '하이퍼클로바X' 기술을 소개하고 있다.[사진=네이버]

◆ 글로벌 초대형 빅테크와 경쟁 본격화..."챗GPT 대결 승률 75%" 

네이버가 초거대AI 모델 하이퍼클로바X를 공식 발표하면서 오픈 AI의 '챗GPT'으로 시작된 '생성형 AI' 시장은 그야말로 춘추전국시대가 열리게 됐다. 현재 오픈AI의 'GPT', 구글의 '팜2', 마이크로소프트(MS)의 'GPT-4' 등 해외 빅테크들의 거대 언어 모델(LLM)이 시장을 선도하고 있는 가운데 네이버가 이들에 맞서 경쟁력을 입증할 수 있을지 관심이 쏠린다.

네이버는 이번에 출시한 '하이퍼클로바X의 파라미터(parameter, 매개변수)를 공개하지 않았다. 매개변수는 입력된 데이터에서 원하는 출력값을 얻기 위해 AI가 찾아내야 하는 변수로, 통상 이 수치가 높으면 우수한 AI모델이라고 평가받는다.

다만 이전 모델인 하이퍼클로바의 성능지표로 하이퍼클로바X의 성능을 가늠해볼 수 있다. 지난 2021년 네이버가 공개한 하이퍼클로바의 매개변수는 2040억개다. 반면 오픈AI가 개발한 초거대 AI 'GPT-3.5'의 매개변수는 1750억개로 하이퍼클로바X보다 낮다 수준이다.

단순 수치상으로 비교해볼 때 네이버의 하이퍼클로바X는 챗GPT에 적용된 초거대AI보다 성능 면에서 우위에 있다고 볼 수 있는 셈이다.

성낙호 네이버클라우드 하이퍼스케일 AI 기술 총괄은 "초거대 규모의 언어모델의 성능을 어떤 하나의 수치로 비교하는 것은 어렵다"라면서도 "내부적으로 우리 모델과 GPT-3.5의 시뮬레이션을 진행해본 결과 75%의 높은 승률을 기록했다"고 말했다. 

생성형 AI의 문제점으로 지적돼온 '환각(hallucination) 현상'에 대해서도 좋은 평가를 받았다. 대표적 대화형 AI 서비스인 챗GPT는 환각현상이 빈번하게 나타나 정확도가 중요한 검색 서비스에 부적절하다는 논란이 있었다. 반면 하이퍼클로바X는 내부 테스트 결과, 자체기술 탑재 후 환각 현상이 72% 감소한 것으로 알려졌다. '환각 현상'은 생성형 인공지능 서비스가 사실이 아닌 것을 사실처럼 말하는 현상이다. 

네이버는 오는 11월 단일 기업으로는 아시아 최대 규모인 60만 유닛 이상의 서버를 수용할 수 있는 하이퍼스케일 데이터센터 '각 세종'을 오픈할 예정이다. '각 세종'은 초대규모AI의 브레인센터 역할을 수행하게 된다.

◆ '국내용' 우려...저작권 논란 '불씨'

네이버에 따르면 하이퍼클로바는 GPT-3보다 한국어 데이터를 약 6500배 이상 학습한 것으로 알려졌다. 한국어 데이터 학습 기반을 통해 영어 형식의 챗 GPT보다 자연스럽고 이해하기 쉬운 한국어로 답변을 해줄 수 있다는 평가가 나온다.

하이퍼클로바X가 영어 중심의 오픈AI '챗GPT'나 구글의 '바드'와 달리, 한국 시장에서 유리한 고지를 선점한 것은 분명하지만, '국내용'이라는 우려의 목소리도 적지 않다. 실제 네이버는 컨퍼런스에서 구체적인 해외 진출 계획을 공개하지 않았다.

최수연 네이버 대표는 해외 시장 진출을 묻는 질문에 "하이버클로바X가 영어·일본어 등 여러 외국어도 굉장히 잘한다"면서도 "이길 수 있는 시장을 먼저 잡기 위해 한국 타깃의 국내 스타트업 수요를 맞춘 것으로, 글로벌 진출 요구에도 대응하겠다"며 모호한 답변을 내놨다. 

성낙호 네이버 총괄은 "유니버셜하게 전체에 대한 데이터를 학습한다면 그걸 똑같은 성능을 발휘하는 인공지능을 만드는 과정에서 훨씬 더 고비용 구조를 가질 수밖에 없다"라며 "우리는 생성형 AI에서도 로컬라이즈된 사업 전략이 필요하다고 생각했고, 한국 시장에 특화된 모델을 만들고 경량화를 진행하고 있다"고 설명했다.

이제 막 개화하는 글로벌 생성형 AI 시장 전망은 굉장히 밝은 편이다. 스탠더드앤드푸어스(S&P) 글로벌 마케팅 인텔리전스가 조사한 전세계 생성형 AI 시장 규모는 올해 37억360만 달러(약 4조 9,606억원) 규모로 연평균 58% 성장해 2028년에는 10배 이상 성장할 것으로 예상했다. 그랜드 뷰 리서치는 Chat GPT 등 생성형 AI에서 비롯된 데이터 서비스 및 솔루션 수요가 2022년 글로벌 시장에서 약 90억 달러(약 11조 9502억원)를 기록했으며, 2030년에는 660억 달러(약 87조 6348억원) 규모로 급성장할 것으로 추정했다.

국내 생성형 AI 시장에 대한 구체적인 자료는 없지만, 국내 AI기업 매출액은 2020년 1조 9506억원에서 지난해 3조 9702억원으로 2배 이상 증가한 것으로 나타났다. 국내 AI 시장 규모가 증가 추세를 보이는 것은 확실하지만 글로벌 시장과 비교해서는 상당한 차이가 나는 셈이다.

네이버는 초거대AI 하이퍼클로바X를 개발하는데 3년동안 1조원 가량을 쏟아 부었다. 앞으로 기술 고도화에 따른 개발 비용으로 천문학적인 추가 비용이 투입될 수 있는 상황에서 해외 시장 점유율 확보는 필수적이다.

네이버가 풀어야할 숙제로 저작권 문제도 남아있다. 앞서 네이버는 보유한 50년치 뉴스와 9년치 블로그 데이터가 생성형AI 학습에 사용됐다며 저작권 논란에 휩싸였다.

최근 한국신문협회는 '생성형 인공지능(AI)의 뉴스 저작권 침해 방지를 위한 신문협회 입장'을 내고 "정당한 권한과 근거 없이 뉴스 콘텐츠를 AI 학습에 이용하는 것은 언론사가 뉴스 콘텐츠에 대해 갖는 저작권 및 데이터베이스(DB) 제작자로서의 권리를 침해하는 것"이라고 입장을 표명한 바 있다.

이와 관련해 최수연 대표는 "하이퍼클로바를 출시할 때 그 학습한 데이터의 규모를 알기 쉽게 전달하는 과정에서 '뉴스 50년치'가 아니고, 1년에 검색되는 뉴스 분량의 50배 혹은 블로그에 몇 배다 이런 식으로 비교해서 언급했는데 그 부분에서 오해가 있었던 것 같다"고 저작권 침해 사실을 부인했다.

Press Q&A에 최수연 대표와 성낙호 네이버클라우드 Hyperscale AI 기술총괄, 김용범 Search US AI 기술총괄, 최재호 AiRSearch 책임리더 등이 참석해 기자들의 질의에 답변했다.[사진=배요한 기자]

yohan@newspim.com

[뉴스핌 베스트 기사]

사진
SKT 이용자 1천명, 공동손배소 예고 [서울=뉴스핌] 최수아 인턴기자 = SK텔레콤(SKT) 유심 정보 해킹 사태와 관련해 이용자 1천여 명이 SKT를 상대로 집단 손해배상 청구 공동소송을 예고했다. 법무법인 대륜은 22일 오전 서울 영등포구 소재 사무실에서 기자회견을 열고 "이번 주 또는 늦어도 다음 주 초에는 약 1000명 규모의 손해배상 소송을 제기할 예정이다"라고 밝혔다. 1인당 손해배상 청구 금액은 100만원으로 전해졌다. [서울=뉴스핌] 양윤모 기자 = 손계준 법무법인 대륜 변호사가 21일 오후 SK텔레콤의 유심(USIM) 정보 유출 사태 고발인 조사를 위해 서울 중구 남대문경찰서에 출석하며 입장을 밝히고 있다. 법무법인 대륜은 유영상 SK텔레콤 대표이사와 보안 담당자 등을 정보통신망법 위반, 위계에 의한 공무집행방해, 배임 등의 혐의로 경찰에 고발했다. 2024.05.21 yym58@newspim.com 대륜은 "집단소송 신청자는 1만 명 이상이나 서류 취합까지 완료된 분들에 한해서만 1차 민사소장 접수 예정"이라고 전했다. 이들은 해당 소장을 접수한 이후에도 2차 소장 모집을 계속할 계획이다.  대륜은 "역대 최대 규모의 유심정보 유출 사고로, 장기간 해킹에 노출된 정황이 있으며 피해자들은 유심 교체 등으로 현실적인 불편을 겪었다"면서 "SKT는 보안에 소홀한 반면 높은 영업이익을 유지해왔고, 지금까지도 피해 규모나 경위에 대해 충분히 밝히지 않고 있다"고 지적했다. 이어 "이러한 점을 종합하여 1인당 100만 원의 위자료 청구가 정당하다고 판단했다"고 설명했다. 또 "SKT는 고객의 개인정보를 안전하게 보호해야 할 의무가 있음에도 불구하고, 정보보호에 있어 구조적인 소홀과 의도적인 비용 감축 정황이 확인된다"고 주장했다. 공동소송이란 원고 또는 피고 혹은 그 쌍방이 여러 사람일 경우, 즉 소송주체가 다수일 경우를 의미한다. 이번 사건처럼 다수에게 피해가 발생했을 때 다수의 피해자가 함께 소송에 참여한다.  앞서 대륜은 지난 1일 SKT 유영상 대표이사와 SKT 보안 책임자를 업무상 배임과 위계 공무집행 방해 등의 혐의로 경찰에 고발했으며 전날(21일) 남대문경찰서에서 고발인 조사를 받았다. geulmal@newspim.com 2025-05-22 12:49
사진
폭스콘 "AI 데이터센터, 단계 건설" [서울=뉴스핌] 고인원 기자= 세계 최대 전자 위탁생산업체인 대만 폭스콘이 미국 반도체 기업 엔비디아와 함께 추진 중인 인공지능(AI) 데이터센터 프로젝트가 최대 100메가와트(MW) 규모로 단계적으로 건설될 예정이라고 밝혔다. 류양웨이 폭스콘 회장은 대만 타이베이에서 열린 '2025 컴퓨텍스 타이베이' 기조연설에서 "이번 AI 데이터센터는 엄청난 전력이 필요한 만큼, 단계적으로 구축할 것"이라며 "1차로 20메가와트 규모로 시작한 뒤, 40메가와트를 추가로 설치할 예정이며, 궁극적으로는 100메가와트까지 확대할 계획"이라고 말했다. 이 프로젝트는 전날 엔비디아가 대만을 대표하는 제조 기업 TSMC·폭스콘 및 대만 정부와 함께 초대형 AI 생태계를 대만에 구축한다고 발표한 데 따른 후속 설명이다. 2024년 10월 8일 대만 타이페이에서 열린 폭스콘 연례 기술 전시회에 전시된 폭스콘 전기이륜차 파워트레인 시스템 [서울=뉴스핌]박공식 기자 = 2025.05.14 kongsikpark@newspim.com 류 회장은 "전력은 대만에서 매우 중요한 자원"이라며 "공급 부족이라는 표현은 쓰고 싶지 않지만, 이를 감안해 여러 도시를 대상으로 부지를 분산하는 방식으로 데이터센터를 건설할 것"이라고 설명했다. 일부 시설은 대만 남서부 가오슝시에 우선 들어서며, 나머지는 전력 여건에 따라 다른 도시로 확대될 수 있다고 덧붙였다. 이날 류 회장의 키노트 무대 위로 젠슨 황 엔비디아 CEO가 깜짝 등장해 눈길을 끌었다. 황 CEO는 "이번 AI 센터는 폭스콘, 엔비디아, 그리고 대만 전체 생태계를 위한 시설"이라며 "우리는 대만을 위한 AI 팩토리를 만들고 있다. 여기에는 대만의 350개 파트너사가 참여하고 있다"고 강조했다. 이번 AI 데이터센터는 고성능 컴퓨팅 인프라 확보를 통해 AI 학습 및 추론 속도를 크게 높이고, 대만 내 AI 산업 생태계 전반에 걸쳐 활용될 것으로 기대된다. koinwon@newspim.com 2025-05-20 23:40
안다쇼핑
Top으로 이동