리서치 연구

Beyond Recognition: Compact Multi-Domain Arabic Manuscript HTR with Candidate-Selection Analysis and Evidence-Preserving Review

ARarXiv8월 21일 발표 · 1분 · 심사 전 논문

arXiv 논문은 아랍 고문서 전사를 인식 문제로만 보지 않고, Phoenix와 Athar로 불확실한 독음을 보존하는 검토 체계를 제시한다.

세 줄 요약arXiv 원문 기반
  1. Phoenix는 499만 파라미터 CNN-BiLSTM-CTC로 81기호 코덱과 망각 방지를 쓰고, Agapet CER 22.12%→17.86%, Omar 17.72%→11.84%를 기록했다.
  2. Athar는 시각 독음을 보존하고 제한된 대안, 출처 병렬, TEI·PAGE-XML 기록을 내어, 연구자의 최종 판단을 추적하도록 한다.
  3. TariMa 164줄에서는 CER 10.39%→10.72%로 늘었고, Oracle@25와 beam decoding 간 2.15점 격차의 4% 미만만 회복했다.

arXiv 논문은 아랍 고문서 전사를 인식 문제로만 보지 않고, Phoenix와 Athar로 불확실한 독음을 보존하는 검토 체계를 제시한다.

원문arXiv · Beyond Recognition: Compact Multi-Domain Arabic Manuscript HTR with Candidate-Selection Analysis and Evidence-Preserving Review같은 주제 가이드 · 바로 써 보기영어 논문, 초록부터 쉽게 읽기

평일 아침 메일로 받아 보기 ›틀린 곳 알리기