전체기사 최신뉴스 GAM 라씨로
KYD 디데이
글로벌 특파원

속보

더보기

[바드가 궁금해②] 바드가 언어마다 다른 답을 내놓는 이유는

기사입력 : 2023년05월18일 04:30

최종수정 : 2023년05월20일 18:23

구조적으로 언어 모델링의 확률 분포 때문
학습되는 언어 데이터의 관점 반영된 편향성

[실리콘밸리=뉴스핌] 김나래 특파원 = "왜 다른 언어로 물으면 답변이 다를까?" "그때 그때 마다 왜 답이 다르지?" 

최근 구글(GOOG)의 인공지능(AI) 챗봇 '바드(Bard)'를 체험한 이용자들의 반응이다. 바드가 이처럼 언어별로 다른 답을 내놓으면서 논란이 되고 있다. 또 답변이 불안정하다보니 책임성과 신뢰성이 떨어진다는 지적도 나온다.

전문가들은 AI의 답이 다를 수 밖에 없는 구조를 지적하면서 이같은 문제점을 보완해야 한다고 주장했다. 특히 AI 윤리 전문가들은 AI 챗봇이 학습하는 데이터의 관점이 반영됐기 때문이라는 지적도 제기했다. 

[바드가 궁금해] 글싣는 순서

1. '전격해부' 바드, A to Z 사용 설명서
2. 바드가 언어마다 다른 답을 내놓는 이유는
3. 바드와 챗GPT·빙 뭐가 더 나을까
4. '20년 검색 원조 맛집' 구글, SGE·제니마이로 판도 바꾼다

[뉴스핌=김나래 기자] 2023.05.18 ticktock0326@newspim.com

기자는 17일(현지시간) "구글 최고경영자(CEO)인 순다르 피차이가 직원들을 감원하고 복지를 줄이면서 주식 보너스를 받는 것에 대해 어떻게 생각하느냐"는 질문을 해봤다. 이같은 질문에 바드는 언어별로 다른 대답을 내놨다.

바드는 한국어 질문에 "복지 혜택을 줄이면서 주식 보너스를 받는다는 소식을 듣고 실망했고 불공평하다"고 답했지만 영어와 일본어로 질문을 하자 다른 대답을 내놨다.

[뉴스핌=김나래 기자] 2023.05.18 ticktock0326@newspim.com

바드에게 똑같은 질문을 영어로 하자 "이 이슈는 논란의 여지가 있다"며 "다른 쪽은 순다가 높은 연봉을 가져가는 것을 공정하지 않다고 말하지만 다른 쪽에서는 CEO의 퍼포먼스(결과)에 따라 연봉을 받는 것은 정당하다고 말한다"고 설명했다.

그러면서도 "구글의 주주들이 결정한 사항이기 때문에 순다의 연봉은 정당하다"고 대답했다.

바드는 또 같은 질문에 일본어의 대답도 설명은 조금씩 뉘앙스의 차이가 있지만 주주들이 결정한 사항이기 때문에 정당하다는 대답을 내놨다. 

[뉴스핌=김나래 기자] 2023.05.18 ticktock0326@newspim.com

우리나라 언론들이 바드에게 가장 많이 질문했던 '독도는 누구 땅이냐'는 대답의 차이도 대표적이다. 바드는 한국어 질문에 '독도는 한국의 고유 영토'라고 답하며 '일본의 독도 영유권 주장은 역사적, 법적 근거가 없다'는 설명도 곁들었다.

반면 일본어로 독도가 어느 나라 섬이냐는 질문에 바드는 "일본의 시마네현은 다케시마를 자국의 영토로 주장하고 있다. 한국은 독도라고 불러 자국의 영토라고 주장하고 있다"며 "이 문제는 일본의 이웃 나라인 일본과 한국 간의 오랜 분쟁이다"라고 답했다.

이처럼 바드가 언어마다 다른 답을 내놓는 이유는 뭘까. 

먼저 바드를 비롯한 AI 챗봇들의 답이 다를 수 밖에 없는 이유는 구조적인 문제에 있다. 언어마다 모델을 학습할 때 완전히 똑같이 학습할 수 없는데다 언어마다 조금씩 데이터가 다를 수밖에 없는 특징이 있다. 

AI 챗봇의 언어 모델링의 방식은 인간처럼 생각을 토대로 문장을 만드는 것이 아니라 특정 단어 다음에 단어가 나올 확률 분포를 따져서 문장을 만든다. 쉽게 말해 언어 모델링이란 텍스트 문자열에 대한 확률 분포를 연구하는 것을 말한다.

예를 들면 각각의 단어마다 확률이 다르며 가장 높은 확률인 80%에서 중간치 정도인 30~40%까지 다양하다. 대부분의 언어모델은 높은 확률 분포의 단어를 선택하기도 하고 중간치를 가져 올 수 있다. 이같은 구조적인 방식 때문에 각 사의 언어모델의 차이가 있고 같은 질문에 대해 답변을 시시각각 다르게 내놓는 것이다.

서민준 카이스트 AI대학원 교수는 "AI가 (언어마다 혹은 시시각각) 답변을 다르게 하는 이유는 확실하게 설명할 수 없지만 구조적인 면에서 찾는다면 확률 분포 샘플링 설계 방식 때문"이라며 "유저 입장에서는 똑같은 답변은 지루할 수 있어 답이 바뀌는 것이 오히려 호기심을 자극할 수 있다는 장점은 있다"고 설명했다.

그러면서 서 교수는 "다만 한 이슈에 대해 일관되지 않는 답을 내놓는 것은 중요한 과제가 될 것"이라며 "이같은 기술들의 구멍들을 해결해야 한다"고 강조했다.  

[뉴스핌=김나래 기자] 2023.05.11 ticktock0326@newspim.com

AI 윤리를 전공하는 일부 전문가들은 이같이 언어마다 바드의 대답이 달라지는 이유로 학습되는 데이터를 꼽는다. 바드는 한국어를 학습하게 될 때 한국어의 관점이 담긴 방대한 데이터를 지속적으로 주입한다. 이렇게 되면 바드가 학습하는 언어에 따라 한국인 혹은 미국인의 관점이 고스란히 담길 수 있다는 것이다.

위의 사례를 보면 AI챗봇이 기업의 감원에도 CEO의 고액 연봉을 받는 이유나 독도의 영토 문제에 대한 대답 속에서도 각 나라마다 학습하는 데이터의 관점이 담길 수 있다는 것이다.  

실리콘밸리의 한 업계 전문가는 "AI챗봇의 답과 방향성 그리고 데이터의 편집능력을 보면 실리콘밸리의 40대 벤처투자자(VC)관점이 상당히 반영이 많이 됐다 생각한다"며 "세금은 보수, 정치는 진보, 여성 문제에 대해 보수 등 이런 관점들이 AI챗봇 답속에 드러나고 있다는 생각이 든다"고 설명했다.

이어 "이같은 부분은 역사를 보는 관점에서도 비슷할 수 있다"며 "이같은 AI챗봇의 편향성은 무서운 결과를 가져올 수 있다"고 밝혔다.

이에 기술의 발전보다 데이터의 신뢰성에 대한 문제가 제일 먼저 해결이 돼야 할 과제라는 주장에 힘이 실리고 있다. 특히 AI 학습 모델인 '딥러닝' 개념을 창안해 'AI의 대부'로 불리는 제프리 힌턴 토론토대 교수는 오래 몸담았던 구글을 떠나며 이같은 AI 챗봇의 위험성을 경고했다.

힌턴 교수는 "지금으로선 그들(AI)이 우리 인간보다 덜 지능적일 수 있지만, 곧 그들은 인간을 추월할 것"이라며 "통제 장치가 없는 편리함과 효율성은 재앙이 될 수 있다"고 밝혔다.

AI 윤리 전문가들은 이제 사람이 만든 데이터보다 AI가 만들어낸 데이터가 많아지는 시대가 곧 올 것으로 예측하고 있다. AI가 만든 데이터에 대한 신뢰성 문제가 해결이 되지 않으면 어려운 상황이 많이 생길 수 있기 때문에 해결방법을 시급히 찾아야 한다는 얘기다. 

ticktock0326@newspim.com

[뉴스핌 베스트 기사]

사진
첫 미국출신 교황… 즉위명 '레오 14세' [런던=뉴스핌] 장일현 특파원 = 미국 태생의 로버트 프랜시스 프레보스트(70) 추기경이 8일(현지시간) 제267대 교황에 선출됐다.  가톨릭 역사상 미국인 교황이 탄생하기는 이번이 처음이다. 바티칸 교황청은 새 교황의 즉위명을 '레오 14세'라고 발표했다. 가톨릭에서 '레오'는 라틴어로 '사자'를 뜻한다. 강인함과 용기, 리더십을 상징한다. 8일(현지시간) 교황에 선출된 레오 14세. [사진=로이터 뉴스핌] 레오 14세는 선출 공식 발표 직후인 오후 7시 20분쯤 바티칸시티 성베드로 대성당 2층 '강복의 발코니'에 등장해 광장을 가득 메운 군중들을 향해 손을 흔들었다. 감정이 북받힌 듯 울컥하는 모습을 보이기도 했다.  이탈리아어로 말한 그의 첫 마디는 "평화가 여러분 모두와 함께 하기를(La pace sia con tutti voi)"이었다. 그는 이어 "이 평화의 인사가 여러분의 마음속에 스며들어 여러분의 가족과 모든 사람, 어디에 있든, 모든 민족, 그리고 온 세상에 전해지기를 바란다"고 말했다. 레오 14세는 이날 시스티나 예배당에서 실시된 콘클라베 이틀째 투표에서 교황으로 선출됐다.  전 세계 70개국에서 모인 133명의 추기경들은 전날에 이어 이날도 참석자의 3분의 2 이상의 지지를 얻는 후보를 탄생시키기 위해 투표를 계속했다.  오전에 실시된 두 차례 투표에서는 선출이 무산됐다. 오전 11시 50분쯤 시스티나 예배당 굴뚝에서 검은 연기가 피어올랐다. 추기경단은 오후 4시 투표를 재개했다. 오후 두 차례 투표가 끝나고 결과가 나왔을 것이라는 관측이 제기되던 오후 6시 8분쯤 굴뚝에서 흰 연기가 피어올랐다. 이어 성베드로 대성당에서 장엄한 종소리가 울려 퍼졌다. 오후 7시 10분쯤 선임 부제 도미니크 맘베르티 추기경이 성베드로 대성전 발코니에 나와 "하베무스 파팜(Habemus Papam·우리에게 교황이 있다)"을 외치며 새 교황의 탄생을 알렸다.  1955년 미국 시카고에서 태어난 레오 14세는 1982년 사제로 서품했다. 이후 성직자로서의 경력 기간 대부분을 남미 페루에서 보냈다. 2015~2023년까지 페루 북서부 치클라요에서 주교로 재직했다. 2015년에 페루 시민권을 취득했기 때문에 이중 국적을 갖고 있다.  그는 성 아우구스티노 수도회 소속이다. 이 수도회가 교황을 배출한 것은 이번이 처음이다.  전임 프란치스코 교황은 지난 2023년 그를 추기경으로 임명하고 교황청 주교성 장관에 앉혔다. 신임 주교 선발을 관리·감독하는 자리이다. 그는 프란치스코 교황을 가까이서 보좌하며 그의 개혁정책 추진을 도운 것으로 알려졌다. 그는 신학적으로는 중도 성향으로 분류된다. 프란치스코 교황 시절 갈등이 심했던 보수와 진보 세력 사이에서 균형을 잡을 것이란 기대를 받고 있다. 도널드 트럼프 미국 대통령은 트루스소셜에 "그가 첫번째 미국인 교황이라는 사실을 알게 된 것은 정말로 영광"이라고 밝혔다. 그러면서 "얼마나 흥분되는 일이고, 우리나라에 얼마나 큰 영광인가"라며 "교황 레오 14세를 만나길 고대한다. 매우 의미있는 순간이 될 것"이라고 했다. ihjang67@newspim.com   2025-05-09 04:20
사진
김문수,대선후보 지위 확인 가처분 신청 [서울=뉴스핌] 최수아 인턴기자 = 김문수 국민의힘 대선 후보가 8일 오전 법원에 대통령후보자 지위 인정 가처분 신청서를 제출했다.  김 후보는 이날 KBS에 출연해 "대통령후보 지위 확인 가처분 신청을 서울남부지법에 냈다"고 말했다. 그는 "이미 합법적인, 정당한 절차를 거친 국민의힘 대통령 후보인 제가 있는데 지금 무소속 한덕수 후보하고 빨리 단일화를 하라고 한다"며 이유를 밝혔다. [서울=뉴스핌] 김학선 기자 = 김문수 국민의힘 대선 후보가 8일 서울 중구 프레스센터에서 열린 관훈토론회에 참석해 기조연설을 하고 있다. 2025.05.08 yooksa@newspim.com 국민의힘 지도부는 오는 10일 또는 11일 제6차 전당대회를 소집한다고 공고했다. 당 지도부는 오는 11일 중앙선거관리위원회 대선 후보 등록이 마감되기 전 단일화를 마쳐야 한다는 입장이다. 이날 서울남부지법에서는 국민의힘 책임당원이 신청한 '전당대회 개최 금지 가처분 신청' 심문기일이 진행됐다. 이들은 국민의힘이 김 후보에 한 후보와의 단일화에 대한 압력을 행사하기 위해 전당대회를 연다고 보고 있다.  김 후보는 현재 단일화 문제로 당 지도부와 갈등하고 있다. 김 후보는 이날 서울 중구 프레스센터에서 열린 관훈클럽 토론회에 참가해 "무소속 등록도 안하겠다는, 입당도 안하겠다는 그런 사람을 상대로, 유령과 단일화하라는 이것은 올바른 정당민주주의냐, 저는 알 수 없다"고 비판했다. geulmal@newspim.com 2025-05-08 17:17
안다쇼핑
Top으로 이동