개인 데이터 주권을 위한 자체 검색 엔진 Hister 소개 — AI 생성 일러스트
개발도구 도구

개인 데이터 주권을 위한 자체 검색 엔진 Hister 소개

asciimoo/hister

GitHub9월 19일 발표 · 3분

Hister는 사용자가 방문한 웹페이지와 로컬 파일을 개인적으로 수집하고 검색할 수 있게 해주는 프라이버시 중심의 자체 검색 엔진입니다.

세 줄 요약GitHub 원문 기반
  1. 단순히 제목이나 URL을 넘어 페이지 전체 내용을 깊이 인덱싱하며, 웹 인터페이스나 터미널 등 다양한 환경에서 정보를 찾을 수 있습니다.
  2. 모든 데이터가 사용자가 직접 통제하는 서버에 저장되어, 외부 클라우드나 제3자 검색 엔진에 의존하지 않는 강력한 개인 정보 주권을 제공합니다.
  3. 로컬 서버 구축이 필요하며, 브라우저 확장 프로그램 설치와 초기 설정을 통해 웹 기록 및 파일을 인덱싱하여 사용해 볼 수 있습니다.

Hister는 사용자가 방문한 웹페이지와 로컬 파일을 대상으로 하는 개인 전용 검색 엔진입니다. 이 시스템은 단순하게 제목이나 URL만 인덱싱하는 것이 아니라, 페이지의 전체 내용을 깊이 있게 색인화하여 정보를 저장합니다. 모든 콘텐츠는 제3자 서비스에 의존하지 않고 사용자가 직접 통제하는 Hister 서버에 보관되어, 강력한 개인 정보 주권을 제공합니다.

Hister를 통해 수집된 데이터는 웹 인터페이스, 터미널(TUI), 또는 를 통해 연결된 AI 비서 등 다양한 환경에서 검색할 수 있습니다. 이 엔진은 필터링, 와일드카드, 부정어 사용이 가능한 강력한 쿼리 기능을 제공하며, 설정에 따라 엔드포인트를 활용하여 의미 기반의 고급 검색(Optional semantic search)도 지원합니다.

사용자는 로컬 환경에서 Hister를 구축할 수 있으며, 이를 위해 바이너리를 다운로드하고 실행하는 과정이 필요합니다. 초기 설정을 통해 브라우저 확장 프로그램으로 웹 기록을 자동 인덱싱하거나, 기존에 존재하는 브라우저 북마크 및 로컬 디렉토리의 파일을 가져와 검색 데이터베이스로 활용할 수 있습니다.

Hister는 기본적으로 텔레메트리나 의무적인 클라우드 서비스를 사용하지 않도록 설계되었습니다. 브라우저 확장 프로그램은 인덱싱된 페이지 내용만 설정된 Hister 서버로 전송하며, 모든 문서와 검색 색인은 해당 로컬 서버에 저장됩니다.

용어 풀이

MCP
AI가 외부 도구·데이터와 연결되는 방식을 정한 공개 표준. Anthropic이 처음 공개했어요.
임베딩
글이나 이미지의 의미를 숫자 목록으로 바꾼 것. 의미가 비슷한 것을 찾을 때 써요.
원문GitHub · asciimoo/hister
원문 보기GitHub