
SK텔레콤과 KT가 자체 거대언어모델(LLM)을 오픈소스로 공개한다. 우리나라 환경에 특화된 LLM을 기업과 개인, 공공에 개방해 인공지능(AI) 대중화에 기여한다는 구상이다.
3일 SK텔레콤과 KT는 자체 LLM인 '에이닷엑스(A.X) 4.0'과 '믿:음 2.0'을 오픈소스 AI 개발자 플랫폼인 허깅페이스에 공개한다고 밝혔다.
SKT가 공개한 A.X 4.0은 현존 LLM 중 최상급의 한국어 처리 효율성은 물론 데이터 보안을 고려한 설계, 그리고 로컬 환경에서의 운영 가능성 등이 강점이다. 오픈소스 모델인 Qwen2.5에 방대한 한국어 데이터를 추가로 학습시켜 국내 비즈니스 환경에 최적화된 성능을 발휘한다.
SKT는 A.X 4.0의 토크나이저를 자체 설계, 적용해 높은 수준의 한국어 처리 역량을 구현했다. 자체 테스트 결과 같은 한국어 문장을 입력했을 때 GPT-4o보다 A.X 4.0이 약 33%가량 높은 토큰 효율을 기록하며, 다른 LLM 대비 높은 정보 처리용량에 비용 절감까지 가능한 경제성을 갖췄다.
또한 A.X 4.0은 대표적인 한국어 능력 평가 벤치마크인 KMMLU2)에서 78.3점을 기록하여, GPT-4o(72.5점)보다 우수한 성능을 보였다. 한국어 및 한국 문화 벤치마크인 CLIcK3)에서도 83.5점을 획득해, GPT-4o(80.2점)보다 더 높은 한국 문화 이해도를 입증했다.
이와 함께 SKT는 A.X 4.0를 기업 내부 서버에 직접 설치해 사용할 수 있는 온프레미스 방식으로 제공할 방침이다. 표준 모델은 720억개(72B), 경량 모델은 70억개(7B)의 매개변수를 갖추고 있어 이용자들이 목적에 맞춰 선택적으로 이용할 수 있도록 했다.
KT 역시 '한국적 AI'의 철학을 담은 믿:음 2.0을 앞세워 국내 AI 생태계 활성화에 기여한다는 방침이다.
믿:음은 한국적 독자 AI 모델로서 고품질 한국어 데이터를 준비하는 과정에서 모든 저작권을 확보해 신뢰성을 높였다. 이번에 선보인 모델은 115억 파라미터 규모의 '믿:음 2.0 Base', 23억 파라미터 규모의 '믿:음 2.0 Mini' 2종이다. 모두 한국어와 영어를 지원한다.
믿:음 2.0 Base는 범용 서비스에 적합한 모델로 한국 특화 지식과 문서 기반의 질의 응답에서 뛰어난 성능을 보인다. 믿:음 2.0 Mini는 Base 모델에서 증류한 지식을 학습한 소형 모델이다.
믿:음 모델은 한국어와 한국 문화 및 사회 등의 전문 분야에서 기존의 국내외 주요 모델을 상회하는 이해력과 생성 성능을 입증했다.
KT와 고려대학교가 공동 개발한 한국어 AI 역량 평가 지표인 'Ko-Sovereign(코-소버린)' 벤치마크에서 유사 규모의 국내 기성 모델을 비롯해 글로벌 최고 수준의 오픈소스 모델을 능가하는 점수를 기록했다.
이와 함께 한국과 관련한 전문 지식의 이해도를 측정하는 대표적 벤치마크 'KMMLU'와 한국어 언어모델 평가 지표인 'HAERAE'에서도 믿:음은 국내외 주요 오픈소스 모델보다 더 우수한 성능을 기록했다.
KT는 국내 교육용 도서와 문학 작품 등의 발간물, 법률 및 특허 문서, 각종 사전 등 다양한 산업·공공·문화 영역에서 방대한 한국 특화 데이터를 확보해 믿:음 2.0 학습에 활용했다.
이외에도 한국어의 구조와 언어학적 특성을 반영한 토크나이저를 자체 개발하고, 필터링으로 줄어든 데이터 규모는 데이터 합성 방법론을 적용해 보완했다. 이를 통해 한국 사회 고유의 언어와 문화적 맥락을 정교하게 반영, 한국어 사용자에 최적화된 언어 이해 능력과 정밀한 표현력을 지닌 모델로 구현했다.
특히 KT는 믿:음 2.0은 AI의 윤리성 및 신뢰성을 높이기 위해 국내외 정책과 가이드라인을 기반으로 전문가들과 함께 만든 'AI 영향 평가 체계'를 적용해 보다 안전하고 투명한 기술을 구현하는 데 힘썼다.
양사는 이번 오픈소스 개방을 시작으로 국내 AI 생태계에 '한국적 AI' 확산 선도에 나선다.
SKT는 이달 중으로 수학 문제 해결과 코드 개발 능력이 강화된 추론형 모델을 공개하고 이미지와 텍스트를 동시에 이해하고 처리할 수 있는 수준까지 모델을 업데이트할 계획이다. 또 소버린 AI 관점에서 A.X 3.0에 적용한 프롬 스크래치 방식도 병행해 개발 중이며, 후속 모델도 순차적으로 공개할 예정이다.
KT는 마이크로소프트(MS)와의 협업으로 GPT-4에 한국적 사고를 추가 학습시키는 방식의 모델 또한 순차 공개할 예정이다.
신동훈 KT Gen AI Lab장(CAIO)은 “믿:음 2.0은 일반적 생성 능력을 갖추면서도 한국의 문화와 언어를 깊이 이해하도록 고도화된 AI 모델”이라며, “국내 사용자들에게 고성능 한국적 AI 모델에 대한 새로운 대안을 제시하는 한편 글로벌 경쟁력을 갖추게 될 중요한 발판이 될 것”이라고 말했다.
박준호 기자 junho@etnews.com