SKT·KT, 한국 특화 'AI 오픈소스' 공개…"AI 대중화 나선다"

조인준 기자 / 기사승인 : 2025-07-03 11:02:52
  • -
  • +
  • 인쇄
▲A.X 4.0의 대규모 학습(CPT)을 진행한 SK텔레콤 자체 구축 슈퍼컴퓨터 '타이탄'(사진=SK텔레콤)

SK텔레콤과 KT가 자체 거대언어모델(LLM)을 오픈소스로 공개했다. 양사는 한국 특화형 LLM을 기업과 개인, 공공에 개방해 국내 인공지능(AI) 대중화에 기여할 방침이다.

SKT와 KT는 자체 개발 LLM인 '에이닷엑스(A.X) 4.0'과 '믿:음 2.0'을 오픈소스 AI 개발자 플랫폼 허깅페이스에 3일 각각 공개했다.

SKT의 A.X 4.0은 현존 LLM 중 최상급의 한국어 처리 효율성을 보이며 데이터 보안을 고려한 설계, 로컬 환경에서의 운영 가능성 등이 강점이다. SKT는 모델에 방대한 한국어 데이터를 추가로 학습시켜 국내 비즈니스 환경에 최적화시켰다.

A.X 4.0의 토크나이저를 자체 설계, 적용해 높은 수준의 한국어 처리 역량을 구현했다. 자체 테스트 결과 같은 한국어 문장을 입력했을 때 GPT-4o보다 A.X 4.0이 약 33% 가량 높은 효율을 기록하며, 다른 LLM 대비 높은 정보 처리용량에 비용 절감까지 가능한 경제성을 갖췄다.

또 대표적인 한국어 능력 평가 벤치마크인 KMMLU2에서 78.3점을 기록하고, 한국어 및 한국 문화 벤치마크인 CLIcK3에서도 83.5점을 획득하는 등 GPT-4o보다 우수한 한국 문화 이해도를 입증했다.

SKT는 A.X 4.0을 기업 내부 서버에 직접 설치해 사용할 수 있는 온프레미스 방식으로 제공할 방침이다. 표준 모델은 720억개, 경량 모델은 70억개의 매개변수를 갖추고 있어 이용자들이 목적에 맞춰 선택적으로 이용할 수 있도록 했다.

KT는 '한국적 AI' 철학을 담은 믿:음 2.0을 앞세워 국내 AI 생태계 활성화에 기여할 것이라고 밝혔다. 믿:음은 한국적 독자 AI 모델로서 고품질 한국어 데이터를 준비하는 과정에서 모든 저작권을 확보해 신뢰성을 높였다. 이번에 선보인 모델은 115억 파라미터 규모인 '믿:음 2.0 Base'와 23억 파라미터 규모의 '믿:음 2.0 Mini' 2종이다.

믿:음 모델은 한국어와 한국 문화 및 사회 등 전문 분야에서 기존의 국내외 주요 모델을 상회하는 이해력과 생성 성능을 입증했다. KT와 고려대학교가 공동 개발한 한국어 AI 역량 평가 지표 'Ko-Sovereign'(코-소버린) 벤치마크에서 글로벌 최고 수준의 오픈소스 모델을 능가하는 점수를 기록했다.

KT는 국내 교육용 도서와 문화 작품 등의 발간물, 법률 및 특허 문서, 각종 사전 등 다양한 산업·공공·문화 영역에서 방대한 한국 특화 데이터를 확보해 믿:음 2.0 학습에 활용했다.

KT는 "한국어의 구조와 언어학적 특성을 반영한 토크나이저를 자체 개발하고, 필터링으로 줄어든 데이터 규모는 데이터 합성 방법론을 적용해 보완했다"며 "이를 통해 한국 사회 고우의 언어와 문화적 맥락을 정교하게 반영, 한국어 사용자에 최적화된 언어 이해 능력과 정밀한 표현력을 지닌 모델로 구현했다"고 설명했다.

양사는 이번 오픈소스 공개를 시작으로 국내에 '한국적 AI' 확산을 통한 생태계 구성 선도에 나설 방침이다. SKT는 이달 내로 수학 문제 해결과 코드 개발 능력이 강화된 추론형 모델을 공개하고 이미지와 텍스트를 동시에 이해하고 처리할 수 있는 수준까지 모델을 업데이트할 계획이다. 또 후속 모델도 순차적으로 공개할 예정이다. KT는 마이크로소프트(MS)와 협업으로 GPT-4에 한국적 사고를 추가 학습시킨 모델을 공개할 계획이라 밝혔다.

Copyright @ NEWSTREE All rights reserved.

뉴스트리 SNS

  • 뉴스트리 네이버 블로그
  • 뉴스트리 네이버 포스트
  • 뉴스트리 유튜브
  • 뉴스트리 페이스북
  • 뉴스트리 인스타그램
  • 뉴스트리 트위터

핫이슈

+

ESG

Video

+

ESG

+

AI 열풍에 빅테크 탄소배출권 구매 '폭증'...MS가 '최다'

글로벌 빅테크 기업들의 탄소배출권 구매량이 급격히 늘고 있다. 인공지능(AI) 경쟁이 가속화로 데이터센터 전력 사용이 급증한 데 따른 것이다.탄소배

쿠팡에 칼 빼든 노동부...과로사·산재은폐 등 의혹에 '산업안전감독'

고용노동부가 16일 쿠팡을 대상으로 산업안전감독에 착수하고 과로사 및 산업재해 은폐 의혹 등을 조사한다.김영훈 노동부 장관은 이날 개최한 '산업

'슈퍼주총' 시즌 자사주 소각 서두르는 기업들...기업가치 개선될까?

3월 '슈퍼주총'을 앞두고 기업들이 앞다퉈 자사주 소각에 나서고 있다. 3차 상법 개정안이 지난 2월 25일 국회 본회의를 통과하면서 상장사들은 보유하

"재생에너지 비중 높을수록 국제유가 충격 줄어든다"-英CCC 분석

미국과 이란의 전쟁으로 국제유가 불안이 커지고 있는 가운데 재생에너지 확대가 에너지 가격 충격을 줄일 수 있다는 분석이다.11일(현지시간) 영국 기

현대차, 中업체와 손잡고 인니 EV배터리 재활용 순환체계 확보

현대차그룹이 인도네시아에서 배터리 순환경제 거점을 마련한다.현대차그룹은 중국 '저장화유리사이클링테크놀로지(화유리사이클)'와 12일 서울 양재

국민연금 기후 주주관여 '반토막'…대상 기업 29개에서 13개로

기후리스크가 주요 투자위험으로 부상하는 가운데 국민연금의 기후관련 주주관여 활동이 최근 크게 줄어든 것으로 나타났다.11일 국회에서 열린 '한국

기후/환경

+

'기후변화' 기대수명 단축시킨다...폭염으로 운동량 감소

기후변화로 폭염일수가 증가하면 신체활동이 크게 줄어들어, 궁극적으로 인간의 기대수명을 크게 단축시킨다는 연구결과가 나와 흥미를 끌고 있다.16

[날씨] 中 산불 연기가 국내까지...전국 미세먼지 '극심'

중국 랴오닝성에서 발생한 산불의 연기가 국내로 유입되면서 대기를 탁하게 만들고 있다.17일 수도권과 강원영서·충청·호남·영남 등 제

남호주 해안 '죽음의 바다'...1년째 적조현상에 해안생물 '멸종위기'

일반적으로 몇 주 안에 사라지는 독성조류가 호주 남부 해안에서 1년 넘게 이어지면서 780종에 달하는 해안생물이 멸종하거나 서식지를 떠나는 등 전례

올여름부터 '폭염중대경보' 신설...'체감 38℃' 넘으면 발효

올여름부터 '체감온도가 38℃ 이상이거나 일 최고기온이 39℃ 이상'인 날이 하루 이상 지속되면 '폭염중대경보'가 발령된다.기상청은 16일 국회 의원회

생물은 온난화 따라 진화할까?..."일정지점 넘으면 생명체 붕괴"

온난화로 지구의 기온이 계속 오르면 생물들도 온도변화에 따라 적응하면서 진화하게 될까?프랑스 국립과학연구센터(CNRS), 아일랜드 트리니티 칼리지

국토부 '그린리모델링' 지원...공사비 대출이자·컨설팅 제공

국토교통부가 기존 건축물의 에너지 성능 개선을 돕고자 '민간 건축물 그린리모델링 이자지원사업'(이하 이자지원사업)을 재개한다고 16일 밝혔다.그

에너지

+

순환경제

+

오피니언

+