로보틱스 도구

lightorigins/LightNav-0

GIGitHub9월 3일 업데이트 · 1분

LightNav-0은 대규모 비전 언어 모델(VLM)을 기반으로 개발된 범용 로봇 내비게이션 모델입니다. 자연어 지시만으로 휴머노이드, 사족 보행 등 다양한 형태의 로봇이 복잡한 환경에서 자율 이동하는 것을 목표로 합니다.

세 줄 요약GitHub 원문 기반
  1. 특정 작업 전용 모듈 없이 단일 토큰 인터페이스를 사용합니다. 이 덕분에 지시 따르기, 객체 탐색, 시각 추적 등 여러 임무를 하나의 구조에서 다양한 로봇 체형에 제로샷으로 적용할 수 있습니다.
  2. 모델은 이중 채널 포인팅과 RVQ 액션 토큰을 통해 공간적 의도를 명확히 파악하고 정밀한 경로 계획 및 실행이 가능하며, 다수의 벤치마크에서 높은 성능을 입증했습니다.
  3. 특히 모델 확장성 분석 결과, 단순히 파라미터나 데이터 양을 늘리는 것보다 '환경의 다양성(Scene Diversity)' 확보가 로봇 지능 향상에 가장 효과적인 핵심 요소임을 보여주었습니다.

LightNav-0은 대규모 비전 언어 모델(VLM)을 기반으로 개발된 범용 로봇 내비게이션 모델입니다. 자연어 지시만으로 휴머노이드, 사족 보행 등 다양한 형태의 로봇이 복잡한 환경에서 자율 이동하는 것을 목표로 합니다.

원문GitHub · lightorigins/LightNav-0

평일 아침 메일로 받아 보기 ›틀린 곳 알리기