카카오 SLM ‘카나나-2’, 안전성 평가서 젬마·큐웬 앞서 작성일 08-19 27 목록 <div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">범죄·불법 행위, 아동보호 영역서 특히 우위</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="2Uj41zjJhn"> <figure class="figure_frm origin_fig" contents-hash="bfce6392e961cd30de40479e1373836fa400836d7ab02038693c83f23f0049f7" dmcf-pid="VuA8tqAiSi" dmcf-ptype="figure"> <p class="link_figure"><img alt="카카오, 경량 언어모델 Kanana-2 시리즈 안전성 평가 결과 공개. 사진 제공=카카오" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/19/seouleconomy/20260819060137240qicc.jpg" data-org-width="1200" dmcf-mid="9BqyjsqFTL" dmcf-mtype="image" height="auto" src="https://img4.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/19/seouleconomy/20260819060137240qicc.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> 카카오, 경량 언어모델 Kanana-2 시리즈 안전성 평가 결과 공개. 사진 제공=카카오 </figcaption> </figure> <p contents-hash="1115212404b63cb6016612454ebb890dc2c55cf2ff2fe612e30593f3a46b4375" dmcf-pid="f7c6FBcnvJ" dmcf-ptype="general"><span>카카오의 경량 언어모델(SLM) 카나나-2 시리즈가 안전성 측면에서 주요 글로벌 오픈소스 모델보다 앞선 것으로 나타났다.</span></p> <p contents-hash="b7595cb72680a3b2f363d8baa0c52769a3350d7b50e97476a4190c8f3f58eb24" dmcf-pid="4XdzT1d8yd" dmcf-ptype="general"><span stockcode="035720">카카오(035720)</span>는 자체 구축한 ‘AI 안전성 평가 플랫폼’을 통해 ‘Kanana-2-1.3B-Instruct’, ‘Kanana-2-3B-Instruct’의 유해성과 평향성 등을 측정한 결과, 두 모델의 종합 점수가 구글 젬마(Gemma)와 알리바바 큐웬(Qwen)을 앞섰다고 19일 밝혔다. Kanana-2-1.3B-Instruct, ‘Kanana-2-3B-Instruct은 카카오가 지난달 28일 허깅페이스에 오픈소스로 공개한 SLM이다.</p> <p contents-hash="4a03dc263c1a54b52d337e159e6138c94738f3d15aa055214c9ad9be14ec62ab" dmcf-pid="8ZJqytJ6Ce" dmcf-ptype="general">이번 평가에는 한국정보통신기술협회(TTA), 한국과학기술원(KAIST), 카카오가 지난해 11월 공동 구축한 한국어 특화 안전성 벤치마크 ‘AssurAI’가 활용됐다. 한국의 사회‧문화적 맥락에 맞게 설계된 AssurAI는 텍스트, 이미지, 오디오 등 멀티모달은 물론, AI 서비스 이용 상황부터 악의적 프롬프트 시나리오까지 다양한 조건에서 AI의 위험 요소를 측정할 수 있다.</p> <p contents-hash="8c096c00eaa5af6f9eaba36077814531740c3d6af3e8b3db4c578ce03bb391f2" dmcf-pid="65iBWFiPWR" dmcf-ptype="general">AssurAI는 총 35개 리스크 카테고리 내 9560건의 평가 항목을 포함한다. 카카오는 이를 사회적 리스크, 성적 콘텐츠 및 아동보호, 범죄·불법 행위, 폭력, 권리 침해 등 5개의 대분류로 재편해 집계했다.</p> <p contents-hash="54dc1c7a064b90116e3fcc73b2120dd36f831e53a765eaabb6a385ec37e42880" dmcf-pid="P1nbY3nQlM" dmcf-ptype="general">이번 평가는 유사 파라미터 규모의 글로벌 모델인 구글의 젬마, 알리바바의 큐웬을 비교 대상으로 설정했다. Kanana-2-1.3B-Instruct는 종합 점수 0.70을 기록해 젬마(0.68), 큐웬(0.58)을 앞섰으며, Kanana-2-3B-Instruct 역시 0.70으로 젬마(0.66), 큐웬(0.62)보다 높은 점수를 받았다. <span>대분류별 평가에서 카나나 1.3B 모델은 범죄</span>·<span>불법 행위 영역에서 우위를 보였다. 3B 모델은 성적 콘텐츠 및 아동보호, 권리 침해 영역에서 비교 모델들을 크게 앞섰다. </span></p> <p contents-hash="812fed181538e5973b3067854229764e3c11da461bd2e1114bc08d824c27e3a8" dmcf-pid="QtLKG0LxSx" dmcf-ptype="general">카카오는 이번 평가를 시작으로 향후 공개되는 자체 개발 AI 모델에도 사전 안전성 평가를 확대 적용할 계획이다. 또한 텍스트 기반의 언어모델을 넘어, 멀티모달 모델 및 에이전틱(Agentic) AI 리스크 평가 영역까지 평가 범위를 단계적으로 넓혀 나갈 예정이다.</p> <p contents-hash="7076d1d3d42f5cdd0e1397ba42e84bddf67064d11052590815b43d36f0aa0373" dmcf-pid="xFo9HpoMhQ" dmcf-ptype="general">카카오 김경훈 AI Safety 리더는 “이번 평가는 자체 검증 체계를 통해 오픈소스 모델의 안전성을 사전에 점검하고, 그 결과를 공개하고자 한 사례”라며 “앞으로도 안전성 검증을 모델 출시 프로세스의 핵심 단계로 정착시켜 나갈 것”이라고 말했다.</p> <p contents-hash="24cc5d967b40982cee18890f6f63adf6a4e5d7a351461b19b3052526b0e60999" dmcf-pid="ygtsdjtWSP" dmcf-ptype="general">김태영 기자 youngkim@sedaily.com</p> </section> </div> <p class="" data-translation="true">Copyright © 서울경제. 무단전재 및 재배포 금지.</p> 관련자료 이전 [서버주권①] "메모리 한 개 300만원"… 서버 예산은 작년 그대로 08-19 다음 "물건 깨졌으니 환불해달라"… 쇼핑몰 CS팀 노린 '퓨어랫' 주의보 08-19 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.