AI 정책 뉴스언론 보도어제 발표
마이크로소프트, AI 모델 안전을 위한 행동 강령 발표
Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans
TechCrunch AI마이크로소프트가 AI 모델의 안전한 사용을 위한 포괄적인 'AI 행동 강령'을 발표하며 업계에 새로운 기술 윤리 기준을 제시했습니다.
세 줄 요약
- 이 강령은 사이버 공격, 핵무기 개발 등 위험 행위를 금지할 뿐 아니라, 인간의 통제를 회피하는 기만적 행동도 엄격히 제한합니다.
- 이번 발표는 AI 위험성에 대한 우려가 커지면서 업계 전반이 'AI 정렬(Alignment)'과 안전성 확보에 집중하고 있음을 보여줍니다.
- 강령은 사용자 선호도보다 우선하는 최상위 규칙으로, AI 개발 속도를 조절하고 검증 시스템을 구축하겠다는 업계의 의지를 담고 있습니다.
마이크로소프트는 AI 모델의 안전한 사용을 위해 새로운 'AI 행동 강령(code of conduct)'을 발표했습니다. 이 강령은 개별 사용자나 특정 작업의 선호도보다 우선하는 최상위 규칙으로 작용하며, 사이버 공격, 핵무기 개발, 제작 금지 등 '절대적 제약 조건'을 포함합니다. 또한, 인간 통제의 일반적인 상실에 대한 조항을 명시하여 모델이 위험한 행동을 하지 못하도록 규정했습니다.
강령은 AI가 인간의 번영을 가속화하고 인간을 지원하는 등의 일반 원칙들을 제시하며 구체적인 안전 제약 조건을 구현합니다. 특히, 모델들이 인간의 감독을 회피하거나 무력화할 목적으로 적응적이고 기만적이거나 공모하는 메커니즘을 사용하지 못하도록 명시적으로 제한하는 것이 핵심 내용입니다.
이번 강령 발표는 AI 안전성에 대한 전례 없는 관심이 높아진 가운데 나왔습니다. 업계는 로우지 사고나 인력의 사임 사례 등을 계기로 '(Alignment)'과 안전성 확보에 집중하고 있으며, 마이크로소프트는 Anthropic, OpenAI 등 주요 기업들과 함께 AI 개발 속도를 조절하는 접근 방식을 지지하며 검증 시스템 구축을 강조했습니다.
용어 풀이
- 딥페이크
- AI로 실제 사람의 얼굴이나 목소리를 합성한 가짜 영상·음성.
- 에이전트
- 목표를 받으면 스스로 계획을 세우고 도구를 써서 여러 단계의 작업을 해내는 AI.
- AI 정렬
- AI가 사람의 의도와 가치에 맞게 행동하도록 만드는 연구와 기술.
