로보틱스 도구
lightorigins/LightNav-0
GIGitHub
LightNav-0은 대규모 비전 언어 모델(VLM)을 기반으로 개발된 범용 로봇 내비게이션 모델입니다. 자연어 지시만으로 휴머노이드, 사족 보행 등 다양한 형태의 로봇이 복잡한 환경에서 자율 이동하는 것을 목표로 합니다.
세 줄 요약
- 특정 작업 전용 모듈 없이 단일 토큰 인터페이스를 사용합니다. 이 덕분에 지시 따르기, 객체 탐색, 시각 추적 등 여러 임무를 하나의 구조에서 다양한 로봇 체형에 제로샷으로 적용할 수 있습니다.
- 모델은 이중 채널 포인팅과 RVQ 액션 토큰을 통해 공간적 의도를 명확히 파악하고 정밀한 경로 계획 및 실행이 가능하며, 다수의 벤치마크에서 높은 성능을 입증했습니다.
- 특히 모델 확장성 분석 결과, 단순히 파라미터나 데이터 양을 늘리는 것보다 '환경의 다양성(Scene Diversity)' 확보가 로봇 지능 향상에 가장 효과적인 핵심 요소임을 보여주었습니다.
LightNav-0은 대규모 비전 언어 모델(VLM)을 기반으로 개발된 범용 로봇 내비게이션 모델입니다. 자연어 지시만으로 휴머노이드, 사족 보행 등 다양한 형태의 로봇이 복잡한 환경에서 자율 이동하는 것을 목표로 합니다.