
카카오(35,800원 ▼1,250 -3.37%)가 허깅페이스에 스마트폰 등과 같은 디바이스에서 구동할 수 있는 경량 언어모델(SLM) 4종을 오픈소스로 공개했다고 28일 밝혔다. Kanana-2 경량 언어모델 시리즈로 △Kanana-2-1.3B-base △Kanana-2-1.3B-instruct △Kanana-2-3B-base △Kanana-2-3B-instruct 등이다.
최근 AI 업계는 대형 언어모델(LLM)의 성능 경쟁과 함께 스마트폰이나 개인 PC 등의 환경에서 직접 구동할 수 있는 경량 언어모델의 중요성이 부각되는 추세다. 글로벌 기업의 경우 온디바이스 AI를 주요 전략으로 내세우거나 경량 오픈소스 모델을 잇달아 공개하는 등 경량 AI 생태계 선점에 나서고 있다.
카카오는 이러한 흐름 속에서 크기가 작더라도 실제 서비스에 적용할 수 있는 수준의 성능을 갖춘 경량 언어모델을 지속해서 연구해왔다. 이번에 공개한 모델 역시 다양한 모델 개발 과정에서 축적한 기술과 경험을 바탕으로 개발됐으며, 현재 '카나나 인 카카오톡', '카카오톡 대화 요약 및 통화 요약', 'AI 국민 비서' 등 다양한 서비스에서 카카오의 경량 모델들이 활용되고 있다.
이번에 공개한 모델들은 작은 크기에도 불구하고 한국어와 영어 모두에서 글로벌 수준의 성능을 구현한 것이 특징이다. 유사 크기의 최신 오픈소스 모델 대비 한국어, 영어, 지식, 수학, 코드 등 대부분의 대표 벤치마크에서 우수한 성능을 기록했다. 특히 오픈소스로 공개한 Kanana-2-1.3B-instruct와 함께 개발한 더 작은 사이즈의 Kanana-2-0.9B-instruct는 대화, 지식, 코드, 수학, 지시이행, 툴 호출 등 실제 서비스 활용 역량에서도 Qwen, Gemma 등 동급 글로벌 모델과 경쟁력 있는 성능을 보였다.
카카오가 자체 개발한 한국어 특화 토크나이저를 적용해 기존 대비 한국어 처리 효율을 30% 이상 개선했다. 토크나이저란 AI 모델이 텍스트를 처리할 때 문장을 잘게 쪼개는 단위를 결정하는 핵심 기술로 한국어에 최적화된 토크나이저를 사용할수록 같은 문장을 더 적은 단위로 처리할 수 있어 연산 속도가 빨라지고 비용도 줄어든다.
스마트폰과 같이 메모리와 연산 자원이 제한적인 온디바이스 환경에 최적화해 설계됐다는 점도 주목할 만하다. 긴 대화를 처리할 때 메모리 사용량이 급격히 늘어나는 문제를 해결하기 위해 '슬라이딩 윈도우 어텐션' 구조를 도입했으며 이를 통해 최대 32K 길이 수준의 대화에서도 메모리를 최대 72.7%까지 절감하면서 안정적인 성능을 유지할 수 있다.
노병석 카카오 유니파이드 파운데이션 모델 성과리더는 "에이전틱 AI 시대를 준비하며 클라우드의 대규모 AI와 온디바이스 경량 AI 모두의 중요성을 체감하고 있다"며 "카카오는 두 영역에서 기술 경쟁력을 높여가고 있으며 이번 오픈소스 공개 모델들이 더 많은 개발자와 기업의 새로운 AI 서비스 개발로 이어져 국내 AI 생태계 활성화에 기여할 수 있기를 바란다"고 말했다.