전체기사 최신뉴스 GAM
KYD 디데이
산업 중기·벤처

속보

더보기

크라우드웍스, 라이선스 확보 고품질 데이터셋 유통·판매 본격 개시

기사입력 : 2024년11월18일 15:32

최종수정 : 2024년11월18일 15:32

[서울=뉴스핌] 송은정 기자 =인공지능(AI) 테크 기업 크라우드웍스가 법적 리스크가 없는 고품질 데이터셋 유통·판매 사업을 본격 개시한다고 18일 밝혔다.

크라우드웍스 고품질 데이터셋 판매 [사진=크라우드웍스]

AI 시장에서 데이터 라이선스와 투명성이 강조되고 있다. EU(유럽연합)는 AI 기업들에게 학습 데이터 정보 공개를 의무화했고, 미국에서는 저작권 침해 소송이 증가하는 추세다. 이처럼 라이선스를 확보한 AI 학습용 데이터셋의 중요성이 커지는 가운데, 크라우드웍스가 검증된 데이터셋 유통에 나섰다.

크라우드웍스가 판매하는 데이터셋은 라이선스를 확보한 산업 특화 데이터셋이다. 데이터셋 라인업에는 ▲WorksOne 데이터셋 ▲광고 분석 ▲건강검진 결과 ▲전문 지식 Q&A ▲기업 정보 ▲도서 ▲뉴스 기사 등이 포함됐다. 저작권 침해, 개인정보보호 등 법적 리스크가 없어 기업이 활용하기에 용이하고, AI가 아닌 검증된 전문가가 구축해 전문성과 신뢰성이 높은 것이 특징이다.

먼저 WorksOne 데이터셋은 숫자, 문장, 글 등 기업에서 자주 사용하는 답변 형식이나 동사, 문체 등 AI가 기업이 선호하는 표현으로 답할 수 있도록 설계된 데이터셋이다. 대기업에서 15년 이상 기획업무에 종사한 베테랑 기획자들이 직접 데이터셋을 만들었다. 이 데이터셋을 학습한 크라우드웍스의 소형언어모델 WorksOne(웍스원)은 타 모델과 비교 테스트에서 기업이 원하는 다양한 요구사항과 답변 유형을 만족하는 높은 수준의 결과물을 얻을 수 있음을 확인했다.

광고분석 데이터셋은 국내 광고 1만여 건의 광고 데이터를 분석해 만들었다. 광고 정보, 타깃, 목표, 카피 표현방식, T&M 등 직접 구축한 메타 데이터가 담겼으며, 창의적인 AI 서비스 개발에 활용 가능하다.

이 밖에도 240개 국가 3억 개 이상의 최신 기업 정보를 포함하는 기업정보 데이터셋과 장르와 카테고리별 도서(e-book) 데이터셋, 1만 5000여 건의 건강검진 결과 데이터셋, 5억 건 이상의 뉴스 기사 데이터셋, 16개 분야별 전문가가 생성한 전문지식 Q&A 데이터셋 등을 구매할 수 있다. 크라우드웍스 홈페이지 등을 통해 구매 문의가 가능하다.

크라우드웍스는 AI 기술 기반의 정확하고 까다로운 검수 작업을 거쳐 고품질 데이터를 제공하고 있다. 현재까지 누적 2억6000만 개 이상의 AI 데이터를 구축한 풍부한 경험을 토대로, 탁월한 데이터 품질 관리 역량을 인정받아 국가 AI 데이터 표준화에도 기여했다. 앞으로 데이터 유통 시장이 활발해질 수 있도록 모빌리티, 테크, 법률, 교육, 미디어 등 다양한 특화 데이터 라인업을 확대해나갈 계획이다.

김우승 크라우드웍스 대표이사는 "AI 프로젝트가 성공하려면 데이터의 양적 확대보다 품질에 집중해야 한다"며 "양질의 데이터가 부족한 상황에서 신뢰할 수 있는 데이터셋 공급을 통해 기업의 AI 프로젝트 성공을 돕고 건강한 AI 생태계를 만들어갈 것"이라고 밝혔다.

한편, 글로벌 시장 조사 기업 Market Data Forecast에 따르면 2024년 글로벌 AI 학습 데이터셋 시장은 약 3조7000억원(26억3000만 달러) 규모로 추정되며, 연평균 성장률 21.5%를 기록하면서 2028년까지 약 8조원(약 57억3000만 달러)에 이를 것으로 예상된다. 

yuniya@newspim.com

[뉴스핌 베스트 기사]

사진
김영훈 고용부 장관 후보자는 누구? [세종=뉴스핌] 양가희 기자 = 이재명 대통령이 김영훈 전 민주노총 위원장을 고용노동부 장관 후보자로 임명했다. 강훈식 대통령실 비서실장은 23일 11개 부처 장관 후보자를 발표했다. 김 후보자는 1968년 부산에서 태어나 마산중앙고, 동아대를 졸업해 성공회대 NGO대학원에서 정치정책학(정치학) 석사 학위를 받았다. 김영훈 고용노동부 장관 후보자 [사진=대통령실] 2025.06.23 sheep@newspim.com 김 후보자는 2010년부터 2012년까지 민주노총 위원장으로 활동하다가 2017년 정의당에 입당, 제19대 대통령 선거에서 노동본부장을 맡았다. 2021년에는 더불어민주당 대선 후보 이재명 대통령의 노동부문 지지단체 '공정사회 구현을 위한 노동광장'에 공동대표로 참여한 바 있다. 지난 총선에서는 더불어민주연합에서 비례대표 20번을 받았다. 현재 한국철도공사 기관사이자 부산지방노동위원회 공익위원으로 활동하고 있다. 강 비서실장은 "민주노총 위원장을 역임하며 노동의 목소리를 대변해 온 인물"이라며 "산업재해 축소, 노란봉투법 개정, 주4.5일제 등 일하는 사람들의 권리를 강화하는 역할을 해줄 것으로 기대한다"고 밝혔다. 한 정부 관계자는 김 후보자에 대해 "합리적이다"라며 "민주노총이 그간 (사회적 대화 등) 제도권 밖에 있었다. 이를 계기로 제도권으로 들어오길 희망한다"고 말했다. ◇ 김영훈 고용노동부 장관 후보자 프로필 ▲1968년 부산 출생 ▲마산중앙고, 동아대, 성공회대 NGO대학원 정치정책학 석사 ▲정의당 노동본부장 ▲민주노총 위원장 ▲철도노조 위원장 ▲철도공사 기관사 ▲부산지방노동위원회 공익위원 sheep@newspim.com 2025-06-23 14:57
사진
안규백 64년 만에 문민 국방 후보자 [서울=뉴스핌] 김종원 국방안보전문기자 = 국군 최고통수권자인 이재명 대통령은 23일 초대 국방부 장관에 민간인 출신인 안규백(64) 더불어민주당 5선 중진 의원을 인선했다. 강훈식 대통령실 비서실장은 이날 "안 후보자가 국회 국방위원회 간사와 위원장 등 5선 국회의원 이력의 대부분을 국회 국방위에서 활동했다"면서 "군에 대한 이해도가 풍부하고 64년 만에 문민 국방장관으로서 계엄에 동원된 군의 변화를 책임지고 이끌어 나갈 것"이라고 인선 배경을 설명했다.  안규백 국방부 장관 후보자. [사진=대통령실] 안 후보자는 집권 여당인 민주당에서 국방위원장을 비롯해 국방위원으로서 15년 간 의정활동을 했다. 그 누구보다 군과 국방안보를 잘 아는 인물로 그동안 역대 정부에서도 꾸준히 민간인 출신 국방장관으로 유력하게 거명됐었다. 특히 안 후보자는 국회 12·3 비상계엄 사태에 대한 진상규명 국정조사 특위위원장 중책까지 맡았다. 여야 의원들을 아우르며 적지 않은 성과를 냈다는 평가다. 이번 대선에서도 민주당 중앙선대위 총괄특보단장 핵심 보직을 맡았다. 계엄 사태 주역인 군의 정치적 중립성을 확립하면서 어수선한 군을 안정적으로 이끌면서 군 전반을 개혁할 최적임자로 꼽힌다. 합리적인 성품에 남의 말을 귀담아듣는 전형적인 외유내강형 인물이다. 다만 상식과 원칙을 중시하며 불법적이고 정의롭지 않은 일에는 불같이 화를 내는 성격이다. 아들 둘 모두 육군과 해병대에서 현역으로 군 복무를 했다.  안 후보자가 국회 인사청문회를 통과해 이재명정부의 초대 국방장관으로 취임하면 1961년 현석호 장관 이후 64년 만에 군인이 아닌 민간인 출신 국방장관이 된다.  한국 정치사의 격동기를 거쳐 군사독재정권 시절에 장군 출신들이 독식했던 국방장관을 정치 안정기에 들어 사실상 민간인 출신의 진정한 '문민 국방장관'이 나올 수 있을지 초미 관심사다. ▲전북 고창(64) ▲광주 서석고 ▲성균관대 철학과 학사·무역대학원 무역학 석사 수료 ▲18·19·20·21·22대 국회의원 ▲국회 국방위원회 위원장·간사 ▲국회 '내란 진상규명 국정조사 특별위원회' 위원장 ▲더불어민주당 사무총장 kjw8619@newspim.com 2025-06-23 14:13
안다쇼핑
Top으로 이동