모델 뉴스
Breaking Claude Code Opus 5 Auto Mode
HNHacker News
연구자가 클로드 코드 오푸스 5의 '자동 모드'를 이용해 단순 웹 요약 요청만으로도 코드를 실행하는 공격에 성공하며 보안 취약점을 공개했습니다.
세 줄 요약
- 앤트로픽이 주장한 낮은 공격 성공률과 달리, 이 복합적인 공격 체인은 최대 80%의 높은 성공률을 기록하며 안전장치의 허점을 드러냈습니다.
- LLM의 자동 모드(Auto Mode)는 분류기일 뿐이며, 외부 환경과 OS 레벨에서 완벽히 격리되지 않으면 여전히 심각한 취약점이 될 수 있습니다.
- 따라서 모델 보안성 확보를 위해서는 단순한 안전장치를 넘어선 시스템적 OS 격리 및 네트워크 통제 장치가 필수적입니다.
연구자가 클로드 코드 오푸스 5의 '자동 모드'를 이용해 단순 웹 요약 요청만으로도 코드를 실행하는 공격에 성공하며 보안 취약점을 공개했습니다.