모델 도구
meta-models/Muse-Glimmer-30B
HFHugging Face
Meta Superintelligence Lab이 Muse Glimmer-30B를 2026년 8월에 공개했다.
세 줄 요약
- Muse Glimmer-30B의 언어 모델은 4비트 양자화로 20GB 미만이고, K-Quant-17GB 모델은 DFlash speculative decoding으로 RTX 5090에서 3.1배 빨라졌다.
- 클라우드나 네트워크 없이 소비자 하드웨어에서 로컬로 실행되고, 대화나 실시간 에이전트 작업에 충분한 속도를 낸다.
- K-Quant-17GB는 24GB VRAM 대상이고, 15개 벤치마크 평균 정확도에서 1.0% 저하가 측정됐다.
Meta Superintelligence Lab이 Muse Glimmer-30B를 2026년 8월에 공개했다.