
KT(대표이사 김영섭)가 ‘한국적 AI’의 철학을 담아 자체 개발한 언어모델(LLM) ‘믿:음 2.0’의 오픈소스를 AI 개발자 플랫폼 허깅페이스(HuggingFace)를 통해 공개한다.
5일 KT에 따르면 ‘믿:음 2.0’의 오픈소스는 기업과 개인, 공공 누구나 상업적으로 활용할 수 있도록 제약 없이 개방된다.
KT는 ‘한국적 AI’에 대해 "KT의 AI 철학으로 한국의 정신과 방식, 지식을 기반으로 구현해 한국에 가장 잘 맞는 AI를 의미한다"고 설명했다.
이를 위해 KT는 한국의 사회적 맥락과 같은 무형의 요소와 한국어 고유의 언어적·문화적 특성 등을 충분히 반영해 학습한 AI 모델을 개발하여 대한민국의 산업과 일상 속에서 AI가 자연스럽게 스며들어 대중화될 수 있도록 앞장서고 있다.
KT의 믿:음은 사전 학습부터 자체적으로 만든 한국적 독자 AI 모델로서 고품질 한국어 데이터를 준비하는 과정에서 모든 저작권을 확보하여 신뢰성을 높였다. 2023년 믿:음 1.0 버전의 Standard, Premium 2종을 출시한 이래 KT AICC(AI 고객센터), 지니TV, AI 전화, 100번 고객센터 등 다양한 서비스에 폭넓게 활용해 왔다.
이번에 KT가 한국적 AI라는 철학을 담아 새롭게 선보이는 믿:음 모델은 ▲115억 파라미터 규모의 ‘믿:음 2.0 Base’ ▲23억 파라미터 규모의 ‘믿:음 2.0 Mini’ 2종으로 모두 한국어와 영어를 지원한다. 믿:음 2.0 Base는 범용 서비스에 적합한 모델로 한국 특화 지식과 문서 기반의 질의 응답에서 강력한 성능을 나타낸다. 믿:음 2.0 Mini는 Base 모델에서 증류한 지식을 학습한 소형 모델이다.
KT 측은 "110억 파라미터 이상의 한국어 범용 LLM을 누구나 상업적으로 활용할 수 있는 오픈소스로 공개한 것은 KT가 처음"이라며 "국내 AI 생태계 활성화에 긍정적인 역할을 할 수 있을 것으로 기대된다"고 말했다.