AI 정책 뉴스
OpenAI's new reasoning technique alarms AI safety experts
HNHacker News
오픈AI의 신규 모델 아스트라가 기존 순차적 사고방식에서 벗어나는 '불투명 재귀(opaque recurrence)' 추론 기법을 사용한다는 보도가 나왔습니다.
세 줄 요약
- 전문가들은 이 기술이 모델의 논리 흐름(CoT) 기록을 모니터링하기 어렵게 만들어, AI 안전성 확보에 심각한 위협이 될 수 있다고 경고했습니다.
- 추론 과정의 투명성이 떨어지면 모델의 오작동이나 잘못된 행동을 사전에 감시하기 어려워져, AI 시스템 통제에 근본적인 문제가 생길 수 있습니다.
- 다만, 현재 아스트라에서의 사용은 제한적이며, 오픈AI는 명확한 CoT 모니터링 시스템을 유지하겠다는 안전 계획을 발표하며 대응하고 있습니다.
오픈AI의 신규 모델 아스트라가 기존 순차적 사고방식에서 벗어나는 '불투명 재귀(opaque recurrence)' 추론 기법을 사용한다는 보도가 나왔습니다.