Muse Glimmer Collection Muse Glimmer 30B: multimodal agentic model for local deployment. BF16 weights, GGUF k-quants, ExecuTorch builds, DFlash drafter. • 4 items • Updated 21 days ago • 106
Running on CPU Upgrade Featured 3.28k The Smol Training Playbook 📚 3.28k The secrets to building world-class LLMs
QUASAR-QAT/Qwen3.8-27B-QUASAR-NVFP4 Image-Text-to-Text • 28B • Updated 3 days ago • 5.52k • 41
Granite 4.2 Language Models Collection Efficient reasoning and thinking language models for multilingual generation, coding, and AI assistant workflows. • 3 items • Updated 6 days ago • 34
MoE-SpAc: Efficient MoE Inference Based on Speculative Activation Utility in Heterogeneous Edge Scenarios Paper • 2603.09983 • Published Feb 12 • 4
FreeToken: Efficient Edge-Native MoE Serving with Bandwidth-Adaptive Execution Paper • 2608.16157 • Published 15 days ago • 104
meta-models/Muse-Glimmer-30B Image-Text-to-Text • 30B • Updated 20 days ago • 600k • • 1.81k