숨겨진 정보가 난제였던 게임 스트라테고, AI 개발 성공
With most information hidden, the game Stratego had stumped AI until now
Hacker News카네기멜론, MIT 등 연구진이 개발한 AI '아타락소스'가 역대 최고 스트라테고 플레이어를 상대로 압도적인 승리를 거두며 난공불락의 기록을 깼습니다.
이 AI가 복잡한 전략 게임에서 승리했다는 것은 인공지능이 높은 효율성과 접근성을 바탕으로 난해하고 불완전한 정보의 문제도 해결할 수 있음을 보여줘요.
- 특히 이 AI는 고가의 장비나 막대한 자원 없이도 개발되어, 인공지능 연구 분야에서 효율성과 접근성을 입증했다는 점에서 주목받습니다.
- 스트라테고는 위치와 말이 숨겨진 '불완전 정보 게임'으로, 수천 번에 달하는 긴 경기 시간과 방대한 변수가 AI에게 큰 난관을 제시했습니다.
- 체스나 포커와 달리, 스트라테고는 40개의 말이 가진 무한에 가까운 배치 가능성과 인간의 심리전(블러핑)이 결합된 복잡성이 핵심 난제입니다.
카네기멜론, MIT, 뉴욕대학교, 스탠퍼드 대학교 연구팀이 개발한 인공지능 '아타락소스'는 역대 최고 스트라테고 플레이어를 상대로 15 대 1의 승리를 거두며 난공불락의 기록을 경신했습니다. 이 AI를 훈련하는 데에는 단지 16개의 와 수천 달러가 사용되어, 인공지능 연구 분야에서 높은 효율성과 접근성을 입증했다는 점에서 주목받고 있습니다.
스트라테고는 플레이어가 원수부터 스파이까지 군사 계급을 대표하는 말 40개와 폭탄, 깃발을 가지고 상대의 깃발을 포획하여 승리하는 게임입니다. 이 게임은 상대방이 자신의 말 위치를 알지만 어떤 종류인지 모르는 '불완전 정보 게임'이며, 말이 공개되는 것은 오직 전투가 발생했을 때뿐입니다.
스트라테고가 AI에게 큰 난관이었던 이유는 단순히 숨겨진 정보를 넘어섭니다. 체스처럼 정해진 수(40수)로 끝나지 않고 쉽게 2,000수에 달할 수 있으며, 말의 무한에 가까운 배치 가능성과 함께 블러핑이라는 인간 심리전이 결합되어 있기 때문입니다. 이러한 복잡성은 딥마인드가 2022년에 선보인 DeepNash 같은 이전 AI들을 난관에 빠뜨렸습니다.
용어 풀이
- GPU
- 많은 계산을 한꺼번에 처리하는 칩. AI 학습과 실행에 가장 많이 써요.
스트라테고가 인공지능에게 어려운 이유는 무엇인가요?
단순히 숨겨진 정보를 넘어서, 게임이 2,000수까지 길어질 수 있고 말의 배치 가능성이 무한에 가깝다는 점과 인간의 심리전인 블러핑이 결합되어 있기 때문이에요.
스트라테고는 어떤 게임인가요?
플레이어들은 원수부터 스파이까지 40개의 군사 계급을 대표하는 말과 폭탄, 깃발을 가지고 상대의 깃발을 포획하여 승리해요. 이 게임은 말이 공개되는 것이 오직 전투가 발생했을 때뿐인 불완전 정보 게임이에요.
개발된 인공지능의 특징은 무엇인가요?
이 AI는 단지 16개의 GPU와 수천 달러만 사용해서 훈련되었기 때문에, 인공지능 연구 분야에서 높은 효율성과 접근성을 입증했다는 점이 주목받고 있어요.