활용 사례 연구
Your Voice Cloning System is Secretly a Voice Anonymizer
ARarXiv
기존 음성 복제 모델(XTTSv2)을 재학습 없이 활용하여 화자의 신원을 제거하는 '음성 익명화' 시스템이 개발되었습니다.
세 줄 요약
- 연구진은 음성 복제 모델이 화자 정체성과 독립적으로 운율 구조를 보존한다는 원리를 이용해 익명화를 구현했습니다.
- 별도의 언어별 훈련 없이도 여러 유럽 언어에서 높은 프라이버시와 명료성을 동시에 확보하여 폭넓은 활용이 가능합니다.
- 프라이버시와 정보 전달력 간의 균형을 최적화하는 방식으로 설계되었으며, 다국어 환경에서 우수한 성능(EER $\approx$ 0.49)을 입증했습니다.
기존 음성 복제 모델(XTTSv2)을 재학습 없이 활용하여 화자의 신원을 제거하는 '음성 익명화' 시스템이 개발되었습니다.