리서치 연구
VIPER: An Expert-Curated Benchmark for Vision-Language Models in Veterinary Pathology
ARarXiv
기존의 인체 중심 병리 모델 평가가 소홀히 했던 동물 조직 검사 분야를 위해, 전문가들이 직접 구축한 최초의 벤치마크(VIPER)가 개발되었습니다.
세 줄 요약
- 16개 모델을 비교 분석한 결과, 동물과 사람 간의 병리학적 차이가 크다는 점이 확인되었으며, 최신 범용 AI 모델들의 과진단 위험성이 드러났습니다.
- 이는 전임상 약물 안전성 평가에 필수적인 분야에서, 해당 영역 특화 학습 및 데이터가 정확하고 신뢰도 높은 예측을 위해 결정적으로 중요함을 시사합니다.
- VIPER는 쥐의 7개 장기 시스템을 대상으로 총 1,251개의 질문으로 구성되었으며, 관련 데이터와 평가 코드가 공개되어 후속 연구에 활용 가능합니다.
기존의 인체 중심 병리 모델 평가가 소홀히 했던 동물 조직 검사 분야를 위해, 전문가들이 직접 구축한 최초의 벤치마크(VIPER)가 개발되었습니다.