leejet/stable-diffusion.cpp
C++로 만든 이미지 생성 엔진, Flux·Qwen 등 최신 모델까지 지원
원제 leejet/stable-diffusion.cpp
스타 7,342당일 +183C++
Key Point
로컬 머신에서 최신 이미지·영상 생성 모델을 실행할 수 있는 경량 C++ 구현이 빠르게 성장하고 있으며, 모델 추가 속도가 빠르므로 개인 또는 온프레미스 AI 구축을 고려하는 개발자에게 선택지가 되고 있다.
핵심 요약
- stable-diffusion.cpp는 GGML 기반의 순수 C/C++ 구현으로 Stable Diffusion, Flux, Wan, Qwen Image 등 다양한 이미지·영상 생성 모델을 추론할 수 있는 경량 프레임워크다.
- 외부 의존성이 없으며, 모델 무게 형식으로 PyTorch 체크포인트(.ckpt, .pth, .pt), Safetensors, GGUF를 지원하고 가중치를 .gguf나 .safetensors로 변환할 수 있다.
- CPU(AVX, AVX2, AVX512), CUDA, Vulkan, Metal, OpenCL, SYCL 백엔드를 지원하며 Linux, macOS, Windows, Android(Termux)에서 실행된다.
- SD 1.x·2.x, SDXL, SD3/3.5, FLUX.1/2, Qwen Image 2.1, Z-Image, Lens, Ideogram4, LTX-2.5 등 30개 이상의 이미지 생성 모델과 Wan2.1/2.2, MiniMax-H3, LTX-2.5, HunyuanVideo 같은 영상 생성 모델을 지원한다.
- IP-Adapter, ControlNet, LoRA, LCM, ADetailer 등의 기능을 포함하며, Flash Attention, VAE 타일 처리, TAESD를 통한 메모리 최적화를 제공한다.
- Euler A, Euler, Heun, DPM++, LCM 등 다양한 샘플링 기법을 지원하고, webui 스타일 토크나이저와 negative prompt를 구현했으며, PNG 출력에 생성 파라미터를 임베드한다.
- 프로젝트는 활발히 개발 중이며 API와 CLI 옵션이 자주 변경될 수 있고, Golang, Python, Rust, C#, Dart 등 여러 언어 바인딩과 GIMP, LocalAI, KoboldCpp 같은 UI/프론트엔드를 지원한다.
저장소 보기 ↗github.com