리서치 연구
LLM의 2차 사회 추론 능력 평가 연구
Beyond Right and Wrong: Evaluating Second-order Social Reasoning in Large Language Models
arXiv기존 AI 윤리 연구가 '규칙 위반 여부' 같은 1차 규범에 집중했다면, 본 연구는 규칙 위반 시 누가, 어떻게 제재할지 예측하는 '2차 사회 추론(메타규범)' 능력을 평가했습니다.
세 줄 요약
- 연구 결과, 현재 LLM들은 인간보다 과도하게 강한 처벌을 예상하며, 특히 사회적 거리가 멀어질수록 규범 준수 여부를 잘못 판단하는 경향을 보였습니다.
- 이는 AI가 갈등 중재나 정책 시뮬레이션 같은 민감한 영역에서 실제 사회의 '관용성'과 '제지'를 간과하고 처벌만을 강조할 위험이 있음을 의미합니다.
- 따라서 AI가 진정한 사회 지능을 갖추려면 단순히 규칙 위반 여부를 아는 것을 넘어 상황적 맥락과 인간의 자율적인 제어 능력을 함께 고려해야 합니다.
기존 AI 윤리 연구가 '규칙 위반 여부' 같은 1차 규범에 집중했다면, 본 연구는 규칙 위반 시 누가, 어떻게 제재할지 예측하는 '2차 사회 추론(메타규범)' 능력을 평가했습니다.