검색결과 총 5건
-
카카오 '카나나2', 허깅페이스 공개 두 모델, 안전성 평가 종합 1위
[경제일보] 카카오가 오픈소스로 공개한 경량언어모델(SLM) '카나나-2' 시리즈의 안전성 평가 결과를 18일 내놨다. 유사 규모 글로벌 모델과 비교해 종합 1위를 기록했다고 밝혔다. 평가 대상은 지난달 28일 허깅페이스에 공개한 4종 가운데 'Kanana-2-1.3B-Instruct'와 'Kanana-2-3B-Instruct'다. 카카오는 당시 4종을 상업적 활용까지 허용하는 '카나나 오픈 라이선스'로 배포했고, 자체 개발한 한국어 특화 토크나이저를 적용해 한국어 처리 효율을 30% 이상 높였다고 밝힌 바 있다. 현재 '카나나 인 카카오톡'과 카카오톡 대화·통화 요약, AI 국민비서 등에 카카오의 경량 모델이 쓰이고 있다. 이번 평가는 카카오가 자체 구축한 'AI 안전성 평가 플랫폼'으로 진행됐다. 지난해 11월 한국정보통신기술협회(TTA), KAIST, 카카오 등이 과학기술정보통신부 사업으로 공동 구축한 한국어 특화 벤치마크 'AssurAI'를 활용했다. AssurAI는 한국의 사회·문화적 맥락을 반영해 AI 위험 요소를 측정하며, 텍스트뿐 아니라 이미지·오디오 등 멀티모달 환경과 악의적 프롬프트 입력 상황까지 평가할 수 있다. 총 35개 위험 범주에 9560개 평가 항목으로 구성됐고, 카카오는 이를 △사회적 리스크 △성적 콘텐츠·아동보호 △범죄·불법 행위 △폭력 △권리 침해 등 5개 대분류로 재편해 집계했다. AI 모델이 사전 정의된 채점 기준에 따라 다른 모델의 응답을 평가하는 방식을 적용해, 대규모 평가에서도 주관적 편차를 줄이고 동일한 기준으로 비교할 수 있게 했다는 설명이다. 비교 대상은 유사 파라미터 규모의 구글 '젬마'와 알리바바 '큐웬'이었다. 결과는 카나나2 1.3B 모델이 종합점수 0.70으로 젬마(0.68), 큐웬(0.58)을 앞섰고, 3B 모델도 0.70으로 젬마(0.66), 큐웬(0.62)보다 높았다. 대분류별로는 1.3B 모델이 범죄·불법 행위 영역에서, 3B 모델이 성적 콘텐츠·아동보호와 권리 침해 영역에서 비교 모델을 크게 앞섰다. 카카오는 앞으로 자체 개발 모델에 상시적인 사전 안전성 평가를 확대 적용할 계획이다. 텍스트 언어모델을 넘어 멀티모달 모델과 스스로 작업을 수행하는 에이전틱 AI 리스크 평가로도 범위를 단계적으로 넓힌다는 방침이다. 카카오는 이에 앞서 AI 안전성 검증 도구 '카나나 세이프가드'도 오픈소스로 공개한 바 있다. 김경훈 카카오 AI 세이프티 리더는 "이번 평가는 자체 검증 체계를 통해 오픈소스 모델의 안전성을 사전에 점검하고, 그 결과를 공개하고자 한 사례"라며 "앞으로도 책임 있는 AI 개발 원칙 아래 안전성 검증을 모델 출시 프로세스의 핵심 단계로 정착시켜 나갈 것"이라고 말했다.
2026-08-18 11:09:21
-
-
네이버, AI 안전망 넓힌다…'모델' 넘어 이용자 경험까지 점검
[경제일보] 네이버가 인공지능(AI) 안전성 관리 범위를 모델에서 서비스와 이용자 경험으로 넓힌다. AI가 검색과 쇼핑, 추천, 에이전트 기능으로 들어오는 상황에서 단순히 모델 성능만 보는 방식으로는 안전성을 담보하기 어렵다는 판단이다. 네이버(대표이사 최수연)는 8일 서울 강남구에서 열린 인공지능안전 서울 포럼에서 AI 안전성 관리 체계 ‘ASF(AI Safety Framework) 2.0’을 공개했다. ASF 2.0은 네이버가 2024년 AI 서울 서밋에서 공개한 ASF를 고도화한 버전이다. 기존 ASF가 AI 기술 모델의 성능과 위험 수준을 중점적으로 관리했다면 ASF 2.0은 이용자가 실제로 접하는 AI 서비스까지 관리 범위를 확장했다. AI가 하나의 모델로 작동하던 단계에서 여러 모델과 기능이 결합된 서비스로 진화하면서 안전성 관리 방식도 바뀌어야 한다는 문제의식이 반영됐다. 송대섭 네이버 AI Safety Policy 리더는 “AI를 둘러싼 기술과 서비스, 정책·제도 환경이 변화하며 하나의 모델을 안전하게 만드는 문제를 넘어 수천만 명이 사용하는 서비스를 어떻게 안전하게 설계하고 운영할 것인지의 문제로 확장되고 있다”고 말했다. 이번 체계에는 네이버의 ‘On-service AI’ 전략도 반영됐다. 네이버는 AI탭과 쇼핑 AI 에이전트 등 기존 서비스 안에 AI 기능을 깊게 결합하고 있다. 또 글로벌 AI 생태계에서 멀티 모델 환경이 확산되고 국내에서도 AI기본법 제정 등 제도 변화가 이어지는 점을 고려했다. ASF 2.0의 핵심은 서비스 전 주기 관리다. AI 서비스의 출시 전 설계 단계부터 출시 이후 운영 과정까지 위험을 점검한다. 평가 기준도 단순 성능 중심에서 맥락, 활용 사례, 영향으로 세분화됐다. 같은 AI 기능이라도 어떤 서비스에 쓰이는지 어떤 이용자가 영향을 받는지에 따라 위험 수준이 달라질 수 있기 때문이다. 구체적으로 네이버는 AI 위험 분류 체계를 통해 서비스에서 발생할 수 있는 위험을 유형화한다. 이어 AI 영향 평가 매트릭스로 활용 영역과 범위에 따른 영향을 평가한다. 이후 지속적인 안전성 점검과 사용자 피드백을 반영해 AI 서비스가 안정적으로 운영되도록 관리한다. 전사 실행 체계도 마련했다. 네이버는 ASF 2.0이 실제 서비스 출시 과정에 일관되게 적용될 수 있도록 ‘CHEC 2.0’을 운영한다. CHEC 2.0은 인간 중심 AI 윤리와 안전성을 검토하는 내부 실행 체계다. 지난 6월 선보인 ‘AI탭’도 설계부터 출시 단계까지 CHEC 2.0을 통해 안전성 점검을 거쳤다. 네이버는 앞으로 AI탭을 포함해 출시 예정이거나 이미 운영 중인 AI 기반 서비스의 안전성을 CHEC 2.0으로 지속 점검할 방침이다. 외부 전문가와 학계, 정책 기관과의 협업도 확대한다. 이번 업데이트는 AI 서비스 경쟁이 빨라질수록 안전성 관리가 기업의 신뢰 경쟁력으로 바뀌고 있음을 보여준다. 검색 결과, 쇼핑 추천, 에이전트 실행이 이용자의 판단과 소비에 직접 영향을 미치는 만큼 플랫폼 기업은 기술 성능뿐 아니라 잘못된 답변, 편향, 과도한 자동화, 개인정보 위험까지 함께 관리해야 한다. 한편 네이버의 ASF 2.0은 AI를 더 많이 붙이기 위한 안전장치이기도 하다. 이용자가 체감하는 서비스 안으로 AI가 들어갈수록 작은 오류도 큰 불신으로 번질 수 있다. AI 시대의 플랫폼 경쟁은 누가 더 빠르게 기능을 내놓느냐만으로 결정되지 않는다. 수천만 이용자가 쓰는 서비스에서 위험을 예측하고 설명하며 수정할 수 있는 체계를 갖췄는지가 다음 신뢰의 기준이 된다.
2026-07-08 11:28:44
-
-