SKT·KT, 한국 특화 'AI 오픈소스' 공개…"AI 대중화 나선다"

조인준 기자 / 기사승인 : 2025-07-03 11:02:52
  • -
  • +
  • 인쇄
▲A.X 4.0의 대규모 학습(CPT)을 진행한 SK텔레콤 자체 구축 슈퍼컴퓨터 '타이탄'(사진=SK텔레콤)

SK텔레콤과 KT가 자체 거대언어모델(LLM)을 오픈소스로 공개했다. 양사는 한국 특화형 LLM을 기업과 개인, 공공에 개방해 국내 인공지능(AI) 대중화에 기여할 방침이다.

SKT와 KT는 자체 개발 LLM인 '에이닷엑스(A.X) 4.0'과 '믿:음 2.0'을 오픈소스 AI 개발자 플랫폼 허깅페이스에 3일 각각 공개했다.

SKT의 A.X 4.0은 현존 LLM 중 최상급의 한국어 처리 효율성을 보이며 데이터 보안을 고려한 설계, 로컬 환경에서의 운영 가능성 등이 강점이다. SKT는 모델에 방대한 한국어 데이터를 추가로 학습시켜 국내 비즈니스 환경에 최적화시켰다.

A.X 4.0의 토크나이저를 자체 설계, 적용해 높은 수준의 한국어 처리 역량을 구현했다. 자체 테스트 결과 같은 한국어 문장을 입력했을 때 GPT-4o보다 A.X 4.0이 약 33% 가량 높은 효율을 기록하며, 다른 LLM 대비 높은 정보 처리용량에 비용 절감까지 가능한 경제성을 갖췄다.

또 대표적인 한국어 능력 평가 벤치마크인 KMMLU2에서 78.3점을 기록하고, 한국어 및 한국 문화 벤치마크인 CLIcK3에서도 83.5점을 획득하는 등 GPT-4o보다 우수한 한국 문화 이해도를 입증했다.

SKT는 A.X 4.0을 기업 내부 서버에 직접 설치해 사용할 수 있는 온프레미스 방식으로 제공할 방침이다. 표준 모델은 720억개, 경량 모델은 70억개의 매개변수를 갖추고 있어 이용자들이 목적에 맞춰 선택적으로 이용할 수 있도록 했다.

KT는 '한국적 AI' 철학을 담은 믿:음 2.0을 앞세워 국내 AI 생태계 활성화에 기여할 것이라고 밝혔다. 믿:음은 한국적 독자 AI 모델로서 고품질 한국어 데이터를 준비하는 과정에서 모든 저작권을 확보해 신뢰성을 높였다. 이번에 선보인 모델은 115억 파라미터 규모인 '믿:음 2.0 Base'와 23억 파라미터 규모의 '믿:음 2.0 Mini' 2종이다.

믿:음 모델은 한국어와 한국 문화 및 사회 등 전문 분야에서 기존의 국내외 주요 모델을 상회하는 이해력과 생성 성능을 입증했다. KT와 고려대학교가 공동 개발한 한국어 AI 역량 평가 지표 'Ko-Sovereign'(코-소버린) 벤치마크에서 글로벌 최고 수준의 오픈소스 모델을 능가하는 점수를 기록했다.

KT는 국내 교육용 도서와 문화 작품 등의 발간물, 법률 및 특허 문서, 각종 사전 등 다양한 산업·공공·문화 영역에서 방대한 한국 특화 데이터를 확보해 믿:음 2.0 학습에 활용했다.

KT는 "한국어의 구조와 언어학적 특성을 반영한 토크나이저를 자체 개발하고, 필터링으로 줄어든 데이터 규모는 데이터 합성 방법론을 적용해 보완했다"며 "이를 통해 한국 사회 고우의 언어와 문화적 맥락을 정교하게 반영, 한국어 사용자에 최적화된 언어 이해 능력과 정밀한 표현력을 지닌 모델로 구현했다"고 설명했다.

양사는 이번 오픈소스 공개를 시작으로 국내에 '한국적 AI' 확산을 통한 생태계 구성 선도에 나설 방침이다. SKT는 이달 내로 수학 문제 해결과 코드 개발 능력이 강화된 추론형 모델을 공개하고 이미지와 텍스트를 동시에 이해하고 처리할 수 있는 수준까지 모델을 업데이트할 계획이다. 또 후속 모델도 순차적으로 공개할 예정이다. KT는 마이크로소프트(MS)와 협업으로 GPT-4에 한국적 사고를 추가 학습시킨 모델을 공개할 계획이라 밝혔다.

Copyright @ NEWSTREE All rights reserved.

뉴스트리 SNS

  • 뉴스트리 네이버 블로그
  • 뉴스트리 네이버 포스트
  • 뉴스트리 유튜브
  • 뉴스트리 페이스북
  • 뉴스트리 인스타그램
  • 뉴스트리 트위터

핫이슈

+

Video

+

ESG

+

LG화학도 사업재편안 제출...석화업계 구조조정 밑그림 완성

LG화학이 정부가 정한 구조조정 제출시한을 열흘가량 남겨놓고 사업재편계획안을 제출했다. 이날 여천NCC와 롯데케미칼도 사업재편계획안을 제출한 것

KCC글라스, KCGS ESG 평가서 3년 연속 '통합A'

KCC글라스가 한국ESG기준원(이하 KCGS)이 발표한 '2025년 KCGS ESG 평가 및 등급'에서 3년 연속으로 통합A 등급을 받았다고 19일 밝혔다.국내 대표 ESG 평가기관

HL만도 "2035년까지 온실가스 63% 감축"…글로벌 이니셔티브 공식 승인

HL그룹 자동차 부문 계열사 HL만도는 글로벌 기후변화 대응 이니셔티브(SBTi)로부터 2035년까지 온실가스 감축 목표를 공식 승인받았다고 19일 밝혔다. SBTi

HLB에너지, 자원순환시설 '그린에너지파크' 준공

HLB생명과학의 자회사 HLB에너지가 부산광역시 사하구에서 친환경 자원순환시설 '그린에너지파크' 준공식을 개최했다고 19일 밝혔다. 18일 열린 준공식

경기도 자원순환마을, 올해 폐기물 30.6톤 재활용

경기도는 올해 '자원순환마을' 18개를 운영해 폐기물 30.6톤을 재활용했다고 19일 밝혔다.자원순환마을은 주민 공동체의 주도로 마을 내 생활쓰레기 문

올해만 몇 번째야?...포스코이앤씨 또 사망사고에 ESG경영 '무색'

포스코이앤씨가 시공을 맡은 신안산선 복선전철 공사현장에서 또 사망사고가 발생했다.19일 서울 영등포경찰서에 따르면 전날 오후 1시 20분께 서울 여

기후/환경

+

"매일 사용하는데"…드라이기·에어프라이어 나노미세먼지 '뿜뿜'

드라이어, 토스트기, 에어프라이어 등 일상에서 많이 사용하는 가정용 가전제품에서 다량의 나노미세먼지(UFP)가 배출된다는 연구결과가 나와 충격을

쓰레기산으로 변하는 히말라야...네팔 '등반객 제한' 초강수

세계 최고봉인 에베레스트산을 비롯한 히말라야 산맥이 쓰레기로 몸살을 앓고 있다. 이에 네팔은 쓰레기 문제를 해결하고자 등반객 수를 제한하는 초

올해 AI가 내뿜은 온실가스 8000만톤..."뉴욕시 배출량과 맞먹어"

올해 인공지능(AI) 열풍으로 인한 이산화탄소 배출량이 뉴욕시 전체 배출량과 맞먹는다는 주장이 나왔다.18일(현지시간) 데이터 분석업체 '디지코노미

27년간 청둥오리 20만마리 사라져...가마우지는 늘었다

국내 청둥오리가 27년에 걸쳐 20만마리 사라진 것으로 파악됐다. 반면 민물가마우지는 200여마리에서 무려 3만마리에 가깝게 폭증했다.국립생물자원관

무역센터에 '수열에너지' 도입...에어컨 7000대 대체효과

한국무역센터에 국내 최대 규모의 수열에너지가 도입된다.한국무역센터에 도입되는 수열에너지는 단일건물 기준 최대 규모인 7000RT(냉동톤)에 달한다.

[주말날씨] 토요일 또 '비소식'...비 그치면 기온 '뚝'

이번 주말에 또 비소식이다.일본 남쪽 해상에 자리한 고기압의 가장자리를 타고 온난한 남풍이 유입되면서 경남권부터 비가 내리겠다. 이 지역에서 19

에너지

+

순환경제

+

오피니언

+