[디지털데일리 이종현기자] 데이터 전문기업 셀렉트스타가 한국의 사회적 가치관 및 공통 지식을 기반으로 대규모언어모델(LLM)을 평가하는 데이터셋 관련 연구 논문을 발표했다.
12일 셀렉트스타는 작년 인공지능(AI) 학습용 데이터 구축 사업의 일환으로 SK텔레콤, LG, 네이버, KT와 함께 마련한 LLM 신뢰성 벤치마크 데이터를 한국과학기술원(KAIST) 김재철AI 대학원과 함께 연구를 고도화한 연구논문 ‘KorNAT’를 첫 공개했다.
셀렉트스타에 따르면 KorNAT 연구의 핵심은 특정 국가의 맞춤형 LLM이 해당 국가 구성원의 사회적 가치관 및 기본 지식과 얼마나 일치(Alignment)하는가를 평가하는 것이다.
기존 벤치마크 데이터는 LLM이 얼마나 문제를 잘 푸는지, 윤리적인 문제는 없는지 등을 다뤘지만 해당 데이터는 의견이 갈릴 수 있는 사회적 가치관과 국가 공통 교육 과정의 기본 지식체 초점을 맞춘 것이 특징이다.
해당 논문은 현재 아카이브에 등재돼 국제학술대회 ‘ACL2024’의 심사 결과를 기다리고 있다. 셀렉트스타는 이번 연구가 국내 LLM 연구의 질과 신뢰성을 한단계 높이는 역할을 할 수 있으리라 기대했다. 또 하반기에는 KorNAT 데이터셋 등 LLM 신뢰성 벤치마크 데이터를 기반으로 온라인 평가가 가능한 공개 리더보드 출시도 예정하고 있다.
Copyright ⓒ 디지털데일리. 무단전재 및 재배포 금지
다시 제기된 'SKT IMEI 유출' 우려…웹셸이 해커 통로됐나(종합)
2025-05-19 16:56:53국회 과방위 “해킹사태, 정부 조사결과 신뢰 어려워…SKT에 배상책임 물을 것”
2025-05-19 16:54:42SKT 해킹, 웹셸서 비롯됐나…“임시서버 보안조치 강화하겠다”
2025-05-19 15:32:33SKT “추가 정보유출, 확인된 바 없다”…2차피해 발생 시 100% 책임
2025-05-19 15:05:22정부 “SKT, IMEI 유출 가능성 있지만…복제폰 생성은 불가”
2025-05-19 13:57:12SKT 해킹서 IMEI 포함된 서버 감염 확인…"유출 여부는 확인 안돼"
2025-05-19 11:09:50[DD퇴근길] 쿠팡 따라잡기? 배민, '티빙 결합상품' 내놓는다
2025-05-19 17:13:45"슈퍼 SON 한 번 더"…쿠팡플레이 시리즈, '토트넘 핫스퍼' 온다
2025-05-19 16:20:55"오리지널이 효자네"…'샤크: 더 스톰', 티빙 유료가입기여자 수 1위
2025-05-19 16:20:37넷마블 '세븐나이츠 리버스', 출시 5일 만에 양대마켓 매출 1위 달성
2025-05-19 16:15:58펄어비스, '붉은사막' 엔비디아 최신 기술 DLSS 4 적용
2025-05-19 15:31:17