LLM EXPLORER 57,252 MODELS INDEXED

Granite 4.0 3B Vision 5bit by mlx-community

By mlx-community · 12 downloads

Granite 4.0 3B Vision 5bit is an open-source language model by mlx-community. Features: 3b LLM, VRAM: 3.5GB, License: apache-2.0, Quantized, LLM Explorer Score: 0.23.

  5-bit   5bit   Adapter Base model:ibm-granite/granite... Base model:quantized:ibm-grani...   Conversational   Custom code   En   Finetuned   Granite4 vision   Image-text-to-text   Lora   Mlx   Quantized   Region:us   Safetensors   Vision

Granite 4.0 3B Vision 5bit Parameters and Internals

LLM NameGranite 4.0 3B Vision 5bit
Repository πŸ€—https://huggingface.co/mlx-community/granite-4.0-3b-vision-5bit 
Base Model(s)  ibm-granite/granite-4.0-3b-vision   ibm-granite/granite-4.0-3b-vision
Model Size3b
Required VRAM3.5 GB
Updated2026-08-08
Maintainermlx-community
Model Files  3.5 GB
Supported Languagesen
Quantization Type5bit
Model ArchitectureAdapter
Licenseapache-2.0
Is Biasednone
Tokenizer ClassGPT2Tokenizer
Padding Token<|pad|>
PEFT TypeLORA
LoRA ModelYes
PEFT Target Moduleslanguage_model.layers.20.self_attn.q_proj|language_model.layers.7.self_attn.q_proj|32.self_attn.k_proj|28.self_attn.q_proj|language_model.layers.14.self_attn.k_proj|language_model.layers.19.self_attn.v_proj|language_model.layers.26.self_attn.k_proj|29.self_attn.q_proj|35.self_attn.k_proj|language_model.layers.8.self_attn.v_proj|34.self_attn.k_proj|language_model.layers.22.self_attn.q_proj|29.self_attn.v_proj|35.self_attn.v_proj|31.self_attn.q_proj|language_model.layers.4.self_attn.q_proj|language_model.layers.18.self_attn.v_proj|language_model.layers.10.self_attn.v_proj|27.self_attn.v_proj|34.self_attn.v_proj|language_model.layers.25.self_attn.v_proj|language_model.layers.21.self_attn.v_proj|language_model.layers.12.self_attn.q_proj|35.self_attn.q_proj|38.self_attn.q_proj|language_model.layers.6.self_attn.q_proj|language_model.layers.22.self_attn.k_proj|language_model.layers.25.self_attn.q_proj|language_model.layers.16.self_attn.q_proj|language_model.layers.16.self_attn.v_proj|language_model.layers.23.self_attn.k_proj|language_model.layers.13.self_attn.q_proj|36.self_attn.q_proj|39.self_attn.q_proj|language_model.layers.2.self_attn.v_proj|37.self_attn.v_proj|27.self_attn.q_proj|language_model.layers.20.self_attn.k_proj|language_model.layers.1.self_attn.k_proj|language_model.layers.1.self_attn.q_proj|37.self_attn.k_proj|input_linear|28.self_attn.k_proj|language_model.layers.12.self_attn.k_proj|language_model.layers.23.self_attn.v_proj|27.self_attn.k_proj|language_model.layers.1.self_attn.v_proj|language_model.layers.7.self_attn.v_proj|language_model.layers.6.self_attn.k_proj|language_model.layers.10.self_attn.k_proj|39.self_attn.k_proj|language_model.layers.14.self_attn.v_proj|language_model.layers.26.self_attn.v_proj|language_model.layers.15.self_attn.v_proj|language_model.layers.8.self_attn.k_proj|language_model.layers.9.self_attn.v_proj|language_model.layers.16.self_attn.k_proj|30.self_attn.v_proj|language_model.layers.3.self_attn.q_proj|33.self_attn.k_proj|36.self_attn.k_proj|o_proj|33.self_attn.v_proj|language_model.layers.15.self_attn.k_proj|language_model.layers.9.self_attn.k_proj|language_model.layers.3.self_attn.v_proj|32.self_attn.q_proj|language_model.layers.6.self_attn.v_proj|language_model.layers.0.self_attn.k_proj|language_model.layers.2.self_attn.q_proj|language_model.layers.9.self_attn.q_proj|language_model.layers.18.self_attn.k_proj|38.self_attn.k_proj|language_model.layers.14.self_attn.q_proj|language_model.layers.0.self_attn.q_proj|30.self_attn.k_proj|language_model.layers.13.self_attn.k_proj|language_model.layers.11.self_attn.v_proj|language_model.layers.4.self_attn.v_proj|31.self_attn.k_proj|language_model.layers.13.self_attn.v_proj|language_model.layers.5.self_attn.v_proj|28.self_attn.v_proj|language_model.layers.24.self_attn.k_proj|language_model.layers.23.self_attn.q_proj|language_model.layers.2.self_attn.k_proj|language_model.layers.5.self_attn.k_proj|language_model.layers.19.self_attn.k_proj|language_model.layers.7.self_attn.k_proj|language_model.layers.4.self_attn.k_proj|language_model.layers.19.self_attn.q_proj|language_model.layers.10.self_attn.q_proj|language_model.layers.25.self_attn.k_proj|language_model.layers.18.self_attn.q_proj|36.self_attn.v_proj|language_model.layers.21.self_attn.k_proj|33.self_attn.q_proj|language_model.layers.24.self_attn.q_proj|34.self_attn.q_proj|output_linear|language_model.layers.5.self_attn.q_proj|39.self_attn.v_proj|38.self_attn.v_proj|language_model.layers.0.self_attn.v_proj|language_model.layers.17.self_attn.q_proj|language_model.layers.3.self_attn.k_proj|29.self_attn.k_proj|language_model.layers.26.self_attn.q_proj|language_model.layers.11.self_attn.k_proj|language_model.layers.24.self_attn.v_proj|language_model.layers.17.self_attn.v_proj|37.self_attn.q_proj|language_model.layers.22.self_attn.v_proj|language_model.layers.17.self_attn.k_proj|language_model.layers.21.self_attn.q_proj|30.self_attn.q_proj|language_model.layers.11.self_attn.q_proj|language_model.layers.8.self_attn.q_proj|language_model.layers.12.self_attn.v_proj|language_model.layers.20.self_attn.v_proj|32.self_attn.v_proj|31.self_attn.v_proj|language_model.layers.15.self_attn.q_proj
LoRA Alpha256
LoRA Dropout0.05
R Param256
Errorsreplace

Best Alternatives to Granite 4.0 3B Vision 5bit

Best Alternatives
Context / RAM
Downloads
Likes
Cc Coder0K / 0.1 GB240
Trained Quant 4bit0K / 0 GB70
Qwen25 3B Korean Pii Qlora20K / 0.1 GB120
...Mental Support Qwen2.5 3B Lora0K / 0.1 GB210
Llama3 Code Lora0K / 0.1 GB132
...ma 3.2 3B Legal India Qlora V20K / 0.1 GB840
Nomi 1.10K / 6.5 GB63
Art Skynet 3B0K / 6.5 GB1115
...ull Lr5e4 Peft Mlp 32 32 Bs2560K / 0.7 GB50
Xenith 3B0K / 7.6 GB22
Note: green Score (e.g. "73.2") means that the model is better than mlx-community/granite-4.0-3b-vision-5bit.