C++ 기반의 경량 확산 모델 추론 엔진 stable-diffusion.cpp — AI 생성 일러스트
개발도구 도구

C++ 기반의 경량 확산 모델 추론 엔진 stable-diffusion.cpp

leejet/stable-diffusion.cpp

GitHub9월 24일 발표 · 2분

Diffusion 모델 추론을 순수 C/C++로 구현하여 경량화에 성공한 프로젝트입니다. 다양한 최신 이미지 생성 AI 모델들을 지속적으로 지원하며 높은 범용성을 자랑합니다.

세 줄 요약GitHub 원문 기반
  1. llama.cpp와 유사한 ggml 기반으로 설계되어 외부 의존성이 적고, CPU, CUDA, Vulkan 등 여러 백엔드에서 구동됩니다. SDXL부터 Qwen Image 2.1까지 광범위한 모델을 포괄합니다.
  2. 다양한 OS와 하드웨어 백엔드를 지원하여 복잡한 환경 설정 없이도 고효율의 이미지 생성이 가능합니다. 이는 AI 기술 접근성을 크게 높여주는 핵심 강점입니다.
  3. 이 프로젝트는 활발히 개발 중인 상태이므로, API나 명령줄 옵션은 빈번하게 변경될 수 있습니다. 사용 전 반드시 최신 문서를 확인하는 것이 중요합니다.

stable-diffusion.cpp는 (SD, Flux 등)의 추론 과정을 순수 C/C++로 구현하여 높은 경량화와 낮은 외부 의존성을 확보한 프로젝트입니다. 이 엔진은 ggml 기반으로 설계되었으며, SD1.x, SDXL부터 Qwen Image 2.1, MiniMax-H3 등 광범위하고 최신 모델들을 지원합니다.

이 도구는 다양한 고급 기능을 통합하여 사용 편의성을 높였습니다. IP-Adapter, Control Net, 같은 기능 외에도 PhotoMaker, LCM/LCM-LoRA 등을 지원하며, 이미지 편집(Image Edit) 및 비디오 모델(Wan2.1/Wan2.2, MiniMax-H3 등)까지 포괄합니다.

기술적으로는 CPU (AVX, AVX2, AVX512), , Vulkan, Metal, OpenCL, SYCL을 포함한 여러 백엔드를 지원하며, Linux, Mac OS, Windows, Android 등 다양한 플랫폼에서 구동이 가능합니다. 사용자는 전용 웹 UI를 통해 바이너리를 다운로드하거나 소스 코드를 빌드할 수 있습니다.

용어 풀이

확산 모델
잡음에서 시작해 조금씩 다듬으며 이미지나 영상을 만들어 내는 생성 모델.
LoRA
모델 전체 대신 작은 추가 부분만 학습시켜 적은 비용으로 미세 조정하는 기법.
CUDA
엔비디아 GPU에서 계산 프로그램을 돌리게 해 주는 개발 플랫폼.
원문GitHub · leejet/stable-diffusion.cpp
원문 보기GitHub