[디지털데일리 이종현기자] 데이터 전문기업 셀렉트스타가 한국의 사회적 가치관 및 공통 지식을 기반으로 대규모언어모델(LLM)을 평가하는 데이터셋 관련 연구 논문을 발표했다.
12일 셀렉트스타는 작년 인공지능(AI) 학습용 데이터 구축 사업의 일환으로 SK텔레콤, LG, 네이버, KT와 함께 마련한 LLM 신뢰성 벤치마크 데이터를 한국과학기술원(KAIST) 김재철AI 대학원과 함께 연구를 고도화한 연구논문 ‘KorNAT’를 첫 공개했다.
셀렉트스타에 따르면 KorNAT 연구의 핵심은 특정 국가의 맞춤형 LLM이 해당 국가 구성원의 사회적 가치관 및 기본 지식과 얼마나 일치(Alignment)하는가를 평가하는 것이다.
기존 벤치마크 데이터는 LLM이 얼마나 문제를 잘 푸는지, 윤리적인 문제는 없는지 등을 다뤘지만 해당 데이터는 의견이 갈릴 수 있는 사회적 가치관과 국가 공통 교육 과정의 기본 지식체 초점을 맞춘 것이 특징이다.
해당 논문은 현재 아카이브에 등재돼 국제학술대회 ‘ACL2024’의 심사 결과를 기다리고 있다. 셀렉트스타는 이번 연구가 국내 LLM 연구의 질과 신뢰성을 한단계 높이는 역할을 할 수 있으리라 기대했다. 또 하반기에는 KorNAT 데이터셋 등 LLM 신뢰성 벤치마크 데이터를 기반으로 온라인 평가가 가능한 공개 리더보드 출시도 예정하고 있다.
Copyright ⓒ 디지털데일리. 무단전재 및 재배포 금지
[알뜰폰경쟁력강화방안]③전광훈도 적자…설비투자 여력있는 사업자는 ‘단 한 곳’
2025-01-18 08:14:00'갤럭시S25 슬림 vs 아이폰17 에어' 두께전쟁 예고
2025-01-17 17:46:11[DD퇴근길] 美 트럼프 취임식, '쿠팡'도 간다…'피지컬: 100', 제작사 바뀐다
2025-01-17 17:33:29'갤럭시S25' 건너 뛰고…'갤S26' 스택형 배터리 탑재 '솔솔'
2025-01-17 16:17:14피지컬: 100 시즌3, 제작 'TEO'로…장호기 PD, '김태호 사단' 합류
2025-01-17 15:34:05"수학 방정식도 풀어준다"...갤럭시 S25 새로운 AI 기능 유출
2025-01-17 13:59:59[현장] 스노우메이지 매력에 ‘일시정지’… 강남 달군 던파 팝업
2025-01-17 17:33:0424시간 후 댓글창 폭파…말 많던 다음뉴스 타임톡, 이용자 불편 듣는다
2025-01-17 15:05:38[IT클로즈업] 분기점 맞은 K-게임, 신흥 시장이 해법될까
2025-01-17 15:02:12[랜선인싸] 슈퍼 E 시선으로 보는 상황별 MBTI…‘아림찌’에 맡겨요
2025-01-17 13:07:24