LLM EXPLORER 58,425 MODELS INDEXED

Muse Glimmer Q4 MLX by RadixArk

By RadixArk · 5949 downloads

Muse Glimmer Q4 MLX is an open-source language model by RadixArk. Features: 30b LLM, VRAM: 15.7GB, Context: 128K, Quantized, LLM Explorer Score: 0.5, ELO: 1426.

  4-bit   Apple-silicon Base model:meta-models/muse-gl... Base model:quantized:meta-mode...   Conversational   Custom code   Mlx   Muse-glimmer   Muse glimmer   Q4   Quantized   Region:us   Safetensors   Sglang   Sharded   Tensorflow

Muse Glimmer Q4 MLX Benchmarks

nn.n% — How the model compares to the reference models: Anthropic Sonnet 3.5 ("so35"), GPT-4o ("gpt4o") or GPT-4 ("gpt4").

Muse Glimmer Q4 MLX Parameters and Internals

LLM NameMuse Glimmer Q4 MLX
Repository πŸ€—https://huggingface.co/RadixArk/Muse-Glimmer-q4-MLX 
Base Model(s)  Muse Glimmer 30B   meta-models/Muse-Glimmer-30B
Model Size30b
Required VRAM15.7 GB
Updated2026-08-14
MaintainerRadixArk
Model Typemuse_glimmer
Model Files  5.3 GB: 1-of-3   5.4 GB: 2-of-3   5.0 GB: 3-of-3
Quantization Typeq4
Model ArchitectureMuseGlimmerForConditionalGeneration
Context Length131072
Model Max Length131072
Tokenizer ClassTokenizersBackend
Padding Token<|finetune_right_pad|>
Vocabulary Size202048

Best Alternatives to Muse Glimmer Q4 MLX

Best Alternatives
Context / RAM
Downloads
Likes
Muse Glimmer 30B 4bit0K / 19.4 GB011
...e Glimmer 30B Unsloth Bnb 4bit0K / 22.2 GB07
...immer 30B Abliterated MLX 6bit0K / 26.4 GB151
Muse Glimmer 30B0K / 59.6 GB01052
Muse Glimmer 30B0K / 59.6 GB2586912
Muse Glimmer 30B AWQ INT40K / 24.1 GB9858
Muse Glimmer 30B AWQ FP80K / 34.5 GB451
Muse Glimmer 30B GPTQ INT40K / 23.9 GB172
Muse Glimmer 30B FP8 Block0K / 34.4 GB194139
Muse Glimmer 30B NVFP4 W4A40K / 12.1 GB109073
Note: green Score (e.g. "73.2") means that the model is better than RadixArk/Muse-Glimmer-q4-MLX.