AI 에이전트 연구
If Agents Were Angels, No Governance Would Be Necessary: Out-of-Band Policy Enforcement at a Trusted Tool Boundary
ARarXiv
AI 에이전트가 인간의 권한을 부여받으면서 발생하는 데이터 접근 및 보안 문제를 해결하기 위해, 추론 과정 외부에서 작동하는 'Out-of-Band Policy Enforcement(OBPE)' 시스템이 개발되었습니다.
세 줄 요약
- OBPE는 호출 전 쿼리를 제한하고 응답 단계에서 민감 필드를 마스킹/필터링하여 데이터 유출 위험을 근본적으로 차단하며, 테스트 결과 실패율은 57.6%에서 0.2%로 급감했습니다.
- 이 기술은 단순한 프롬프트 기반의 가이드라인 의존성을 넘어, 에이전트가 권한 범위를 초과하거나 기밀 정보를 다루는 것을 시스템 레벨에서 통제할 수 있게 합니다.
- 다만 현재 평가는 데이터 조회 및 필터링에 중점을 두었으며, 쓰기(Write) 권한 제어, 영구 승인 절차 등은 평가 범위에 포함되지 않은 한계가 있습니다.
AI 에이전트가 인간의 권한을 부여받으면서 발생하는 데이터 접근 및 보안 문제를 해결하기 위해, 추론 과정 외부에서 작동하는 'Out-of-Band Policy Enforcement(OBPE)' 시스템이 개발되었습니다.