모델 도구

empero-ai/Qwen3.8-27B-Ridge-GGUF

HFHugging Face발표일 미상 · 1분

Empero가 Qwen3.8-27B를 llama.cpp 계열 런타임에서 쓰는 GGUF 양자화 파일로 공개했습니다.

세 줄 요약Hugging Face 원문 기반
  1. 파일은 3.69bpw, 11.73GiB로 Gated-DeltaNet 상태를 Q8_0, 믹서를 Q4_K로 두고 MTP 헤드도 포함했습니다.
  2. 텍스트만 쓰면 16GB급 GPU가 실용적인 시작점이고, 이미지 입력은 0.87GiB mmproj를 함께 내려받아야 합니다.
  3. 손실은 있고, 긴 컨텍스트는 KV 캐시가 메모리를 차지하며, MTP 속도 향상은 draft-mtp 런타임이 필요합니다.

Empero가 Qwen3.8-27B를 llama.cpp 계열 런타임에서 쓰는 GGUF 양자화 파일로 공개했습니다.

원문Hugging Face · empero-ai/Qwen3.8-27B-Ridge-GGUF같은 주제 가이드 · 바로 써 보기내 업무 예시로 AI 모델 비교하기

평일 아침 메일로 받아 보기 ›틀린 곳 알리기