article detail
“맘대로 해킹하는 AI 잡는다” 화이트해커 AI 등장...공격 루트 7배 많이 찾아
2026. 7. 30. 오후 5:30
AI 요약
김준모 KAIST 전기및전자공학부 교수가 대규모언어모델(LLM)의 안전성을 검증하는 프레임워크 스테이블-지플로우넷(S-GFN)을 개발해 생성형 AI의 위험 요인과 공격 루트를 미리 점검·차단하는 AI 화이트해커 기술을 발표했습니다. 이 기술은 토너먼트 방식으로 다양한 공격 루트를 탐색하고 프롬프트 유창성까지 평가해 기존 대비 약 7배 더 많은 공격 루트를 찾아냈으며, AI가 만든 공격 루트의 성공률은 92.6%였습니다. 미리 찾아낸 공격 루트로 학습한 AI 모델의 방어율은 기존 약 77%에서 99.8%로 상승했으며 해당 논문은 국제머신러닝학회 2026에서 스포트라이트 논문으로 선정되었습니다.