활용 사례 도구
facebook/mms-300m
HFHugging Face
페이스북 AI가 1,400개 이상의 언어와 약 50만 시간에 달하는 방대한 음성 데이터로 학습한 다국어 사전 학습 모델 MMS를 공개했습니다.
세 줄 요약
- 이 모델은 Wav2Vec2의 자기 지도 학습 목표를 기반으로 구축되어, 단순히 단어를 인식하는 것을 넘어 음성의 구조 자체를 이해하도록 설계되었습니다.
- 사용자는 이 강력한 기본 모델을 자동 음성 인식(ASR), 번역, 분류 등 실제 필요한 하위 작업에 맞게 미세 조정하여 활용할 수 있습니다.
- 모델 사용 시에는 입력 데이터가 반드시 16kHz로 샘플링되어야 하며, 원하는 성능을 얻기 위해서는 후속적인 미세 조정 과정이 필수적입니다.
페이스북 AI가 1,400개 이상의 언어와 약 50만 시간에 달하는 방대한 음성 데이터로 학습한 다국어 사전 학습 모델 MMS를 공개했습니다.