article detail
AI 안전, 선언보단 검증으로…국제표준도 달라진다
2026. 9. 22. 오후 3:46
AI 요약
인공지능(AI) 안전과 신뢰성에 대한 국제표준 논의가 원칙 중심에서 이를 입증할 수 있는 증거 중심으로 이동하고 있다고 전종홍 한국전자통신연구원(ETRI) 표준연구본부 책임연구원이 22일 서울대 인공지능신뢰성연구센터 월례세미나에서 밝혔습니다. AI를 직접 공격해 취약점을 찾는 레드팀 테스트와 어떤 안전·신뢰 기준을 충족했는지 근거와 함께 보여주는 신뢰성 사실 라벨(TFL) 등이 국제표준으로 개발되고 있으며, 전 책임연구원이 국제표준 에디터를 맡은 ISO/IEC 42119-7은 레드팀 절차를 규정해 2027년 5월 제정을 목표로 하고 있습니다. 레드팀에는 여러 AI 에이전트를 활용해 공격을 자동화하는 사례가 있어 한 참가자가 AI 에이전트 약 30개를 동시 가동했고 제출된 공격 사례는 약 4,900건에서 1만 7,500건으로 늘었으며, TFL은 위험관리 체계·편향·취약점 시험·사람의 통제 가능성 등 시험·인증 결과를 연결해 사람과 AI가 읽을 수 있는 형태로 표시하는 방식입니다.