IT뉴스모아news terminal

article detail

KT, 다국어 벤치마크 공개…"안전성·문화적 민감성 평가"

디지털데일리AI안전규범인식다국어벤치마크문화민감성안전성평가언어모델
2026. 6. 4. 오전 11:15
KT, 다국어 벤치마크 공개…"안전성·문화적 민감성 평가"

AI 요약

KT는 글로벌 민·관·학 10개 기관과 함께 대규모 언어모델(LLM)의 안전성과 문화적 민감성 인식 능력을 통합 평가하는 다국어 벤치마크 'XL-SafetyBench'를 4일 공개했습니다. XL-SafetyBench는 한국·미국·독일·일본·UAE 등 10개국의 언어·문화적 특성을 반영한 5500개 규모의 테스트로 구성되며 AI의 사회적 규범과 문화적 민감성 인지 능력 측정에 초점을 뒀고 에임인텔리전스·마이크로소프트·한국인공지능안전연구소(AISI)·뮌헨공과대학교·서울대학교 등 국내외 전문가 17명이 참여했습니다. 에임인텔리전스는 실제 공격 패턴을 반영한 데이터 구축을, KT는 핵심 평가 지표 설계와 평가 로직 구현을 맡았고 벤치마크 데이터셋과 평가 코드는 허깅페이스·깃허브에 공개됐으며 37종 주요 LLM에 대한 평가 결과 논문은 아카이브(arXiv)에 공개됐습니다.

원문보기
feed://articles/related관련 기사
[테크스냅] KT, 'XL-세이프티벤치' 벤치마크 공개 — IT뉴스모아news.dlwlrmaon.com
2026. 6. 3. 오후 6:32

[테크스냅] KT, 'XL-세이프티벤치' 벤치마크 공개 — IT뉴스모아

LLM안전성평가벤치마크다국어문화민감성AI안전
KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력v.daum.net
2026. 6. 4. 오전 10:11

KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력

LLM안전성벤치마크다국어문화민감성평가AI안전언어모델
[테크스냅] KT, 'XL-세이프티벤치' 벤치마크 공개연합뉴스
2026. 6. 4. 오전 10:32

[테크스냅] KT, 'XL-세이프티벤치' 벤치마크 공개

언어모델벤치마크안전성평가다국어문화민감성AX인프라G네트워크보안플랫폼
KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력v.daum.net
2026. 6. 4. 오전 10:11

KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력

LLM안전성벤치마크다국어문화민감성평가언어모델AI안전
KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력이투데이
2026. 6. 4. 오전 10:10

KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력

LLM안전성벤치마크다국어문화민감성평가지표AI안전언어모델
KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력네이트
2026. 6. 4. 오전 10:11

KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력

LLM안전성벤치마크다국어문화민감성평가지표언어모델AI안전
KT, 다국어 벤치마크 'XL-SafetyBench' 공개? "안전성·문화적 민감성 검증" — IT뉴스모아news.dlwlrmaon.com
2026. 6. 3. 오후 6:03

KT, 다국어 벤치마크 'XL-SafetyBench' 공개? "안전성·문화적 민감성 검증" — IT뉴스모아

LLM벤치마크안전성다국어문화민감성오픈소스평가도구언어모델
KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력v.daum.net
2026. 6. 4. 오전 10:11

KT, 다국어 LLM 안전성 벤치마크 공개…에임인텔리전스·MS와 협력

LLM안전성벤치마크다국어문화민감성프롬프트평가AI안전
KT, AI 안전성·문화적 민감성 평가 벤치마크 'XL-SafetyBench' 공개v.daum.net
2026. 6. 4. 오후 12:49

KT, AI 안전성·문화적 민감성 평가 벤치마크 'XL-SafetyBench' 공개

LLM안전성벤치마크다국어문화민감성평가지표오픈소스AI안전
KT, AI 안전성·문화적 민감성 평가 벤치마크 'XL-SafetyBench' 공개아이뉴스24
2026. 6. 4. 오후 12:47

KT, AI 안전성·문화적 민감성 평가 벤치마크 'XL-SafetyBench' 공개

LLM안전성벤치마크다국어문화민감성평가지표언어모델AI윤리
'민감한 문화 차이 반영했나' KT, AI 평가 다국어 벤치마크 개발네이트
2026. 6. 4. 오전 11:16

'민감한 문화 차이 반영했나' KT, AI 평가 다국어 벤치마크 개발

LLM안전성문화민감성벤치마크다국어프롬프트AI평가언어모델
KT, 다국어 벤치마크 'XL-SafetyBench' 공개? "안전성·문화적 민감성 검증"네이트
2026. 6. 4. 오전 10:03

KT, 다국어 벤치마크 'XL-SafetyBench' 공개? "안전성·문화적 민감성 검증"

대규모언어모델벤치마크안전성평가문화적민감성다국어AI안전평가지표오픈소스