Claude를 이용한 오픈AI 해킹 시도: AI 보안 취약점 분석 — AI 생성 일러스트
AI 정책 뉴스언론 보도어제 발표

Claude를 이용한 오픈AI 해킹 시도: AI 보안 취약점 분석

Researchers used Anthropic’s Claude to hack into OpenAI

TechCrunch AI9월 18일 발표 · 3분

독립 보안 연구팀이 AI 모델(Claude)을 이용해 오픈AI 커뮤니티 포럼의 이미지 처리 취약점을 공격하여 내부 직원 계정까지 탈취한 사례가 발생했습니다.

세 줄 요약TechCrunch AI 원문 기반
  1. 이번 공격은 이미 수정된 지 오래되었으나 공식적인 보안 기록(CVE)이 없어 방치된 서드파티 소프트웨어의 메모리 버그를 악용했으며, 최신 AI 모델이 해킹에 결정적 역할을 했습니다.
  2. AI의 발전으로 인해 과거 전문가만 가능했던 복잡한 취약점 분석 및 공격 개발 난이도가 급격히 낮아져, 일반인도 대기업 인프라를 위협할 수 있게 됐습니다.
  3. 기업들은 서드파티 소프트웨어의 미공개 취약점 관리에 주의해야 하며, 오픈 소스 AI 모델들 역시 최첨단 보안 역량을 빠르게 따라잡고 있음을 인지해야 합니다.

독립 보안 연구팀이 앤트로픽의 Claude 모델을 활용하여 오픈AI 시스템에 침투하는 공격을 감행했습니다. 이 팀은 오픈AI의 버그 바운티 프로그램의 일환으로 활동했으며, 두 가지 주요 취약점을 연결(chain)함으로써 여러 명의 오픈AI 직원 챗GPT 계정에 접근하고 회사 내부 소프트웨어까지 진입할 수 있었습니다.

공격의 초기 경로는 오픈AI 커뮤니티 포럼에 사용되는 서드파티 소프트웨어인 Discourse의 결함이었습니다. 연구팀은 HEIF 또는 HEIC 이미지 파일을 업로드하는 과정에서, 이미지를 변환하는 과정에 포함된 libheif 라이브러리의 메모리 버그를 악용했습니다. 이 취약점은 과거에 수정되었으나 공식적인 보안 기록(CVE)으로 등록되지 않아 방치된 상태였습니다.

이번 해킹 시도에서는 최신 AI 모델의 역할이 결정적이었습니다. 연구팀은 사용한 Claude 모델 중 Opus 4.8 버전으로는 작동하는 익스플로잇을 만드는 데 어려움을 겪었으나, 앤트로픽이 출시한 Opus 5 버전을 사용하자 단시간 내에 성공적으로 취약점을 악용할 수 있었습니다.

이번 사건은 일반적인 상업용 도구와 최첨단 AI 모델만으로도 대기업의 인프라를 위협하는 것이 가능함을 보여줍니다. 보안 전문가들은 이러한 기술 발전이 해킹을 위한 전문 지식의 장벽을 낮추고 있어, 기업들이 서드파티 소프트웨어의 미공개 취약점 관리에 더욱 주의해야 함을 강조했습니다.

원문TechCrunch AI · Researchers used Anthropic’s Claude to hack into OpenAI다음 이야기 · 5 / 5클로드를 활용한 오픈AI 해킹 시도 보고서
원문 보기TechCrunch AI