LLM EXPLORER 57,252 MODELS INDEXED

Granite 4.0 3B Vision by ibm-granite

By ibm-granite · 841 downloads

Granite 4.0 3B Vision is an open-source language model by ibm-granite. Features: 3b LLM, VRAM: 8.5GB, License: apache-2.0, LLM Explorer Score: 0.27.

  Arxiv:2208.00385   Arxiv:2404.19205   Arxiv:2406.04334   Arxiv:2412.07626   Arxiv:2502.09927   Arxiv:2512.10888   Arxiv:2603.27064   Conversational   Custom code   En   Endpoints compatible   Granite4 vision   Image-text-to-text   Lora   Region:us   Safetensors   Sharded   Tensorflow   Vision

Granite 4.0 3B Vision Parameters and Internals

LLM NameGranite 4.0 3B Vision
Repository πŸ€—https://huggingface.co/ibm-granite/granite-4.0-3b-vision 
Model Size3b
Required VRAM8.5 GB
Updated2026-08-08
Maintaineribm-granite
Model Files  0.9 GB   5.0 GB: 1-of-2   3.5 GB: 2-of-2
Supported Languagesen
Model ArchitectureAutoModelForMultimodalLM
Licenseapache-2.0
Is Biasednone
Tokenizer ClassGPT2Tokenizer
Padding Token<|pad|>
PEFT TypeLORA
LoRA ModelYes
PEFT Target Moduleslanguage_model.layers.20.self_attn.q_proj|language_model.layers.7.self_attn.q_proj|32.self_attn.k_proj|28.self_attn.q_proj|language_model.layers.14.self_attn.k_proj|language_model.layers.19.self_attn.v_proj|language_model.layers.26.self_attn.k_proj|29.self_attn.q_proj|35.self_attn.k_proj|language_model.layers.8.self_attn.v_proj|34.self_attn.k_proj|language_model.layers.22.self_attn.q_proj|29.self_attn.v_proj|35.self_attn.v_proj|31.self_attn.q_proj|language_model.layers.4.self_attn.q_proj|language_model.layers.18.self_attn.v_proj|language_model.layers.10.self_attn.v_proj|27.self_attn.v_proj|34.self_attn.v_proj|language_model.layers.25.self_attn.v_proj|language_model.layers.21.self_attn.v_proj|language_model.layers.12.self_attn.q_proj|35.self_attn.q_proj|38.self_attn.q_proj|language_model.layers.6.self_attn.q_proj|language_model.layers.22.self_attn.k_proj|language_model.layers.25.self_attn.q_proj|language_model.layers.16.self_attn.q_proj|language_model.layers.16.self_attn.v_proj|language_model.layers.23.self_attn.k_proj|language_model.layers.13.self_attn.q_proj|36.self_attn.q_proj|39.self_attn.q_proj|language_model.layers.2.self_attn.v_proj|37.self_attn.v_proj|27.self_attn.q_proj|language_model.layers.20.self_attn.k_proj|language_model.layers.1.self_attn.k_proj|language_model.layers.1.self_attn.q_proj|37.self_attn.k_proj|input_linear|28.self_attn.k_proj|language_model.layers.12.self_attn.k_proj|language_model.layers.23.self_attn.v_proj|27.self_attn.k_proj|language_model.layers.1.self_attn.v_proj|language_model.layers.7.self_attn.v_proj|language_model.layers.6.self_attn.k_proj|language_model.layers.10.self_attn.k_proj|39.self_attn.k_proj|language_model.layers.14.self_attn.v_proj|language_model.layers.26.self_attn.v_proj|language_model.layers.15.self_attn.v_proj|language_model.layers.8.self_attn.k_proj|language_model.layers.9.self_attn.v_proj|language_model.layers.16.self_attn.k_proj|30.self_attn.v_proj|language_model.layers.3.self_attn.q_proj|33.self_attn.k_proj|36.self_attn.k_proj|o_proj|33.self_attn.v_proj|language_model.layers.15.self_attn.k_proj|language_model.layers.9.self_attn.k_proj|language_model.layers.3.self_attn.v_proj|32.self_attn.q_proj|language_model.layers.6.self_attn.v_proj|language_model.layers.0.self_attn.k_proj|language_model.layers.2.self_attn.q_proj|language_model.layers.9.self_attn.q_proj|language_model.layers.18.self_attn.k_proj|38.self_attn.k_proj|language_model.layers.14.self_attn.q_proj|language_model.layers.0.self_attn.q_proj|30.self_attn.k_proj|language_model.layers.13.self_attn.k_proj|language_model.layers.11.self_attn.v_proj|language_model.layers.4.self_attn.v_proj|31.self_attn.k_proj|language_model.layers.13.self_attn.v_proj|language_model.layers.5.self_attn.v_proj|28.self_attn.v_proj|language_model.layers.24.self_attn.k_proj|language_model.layers.23.self_attn.q_proj|language_model.layers.2.self_attn.k_proj|language_model.layers.5.self_attn.k_proj|language_model.layers.19.self_attn.k_proj|language_model.layers.7.self_attn.k_proj|language_model.layers.4.self_attn.k_proj|language_model.layers.19.self_attn.q_proj|language_model.layers.10.self_attn.q_proj|language_model.layers.25.self_attn.k_proj|language_model.layers.18.self_attn.q_proj|36.self_attn.v_proj|language_model.layers.21.self_attn.k_proj|33.self_attn.q_proj|language_model.layers.24.self_attn.q_proj|34.self_attn.q_proj|output_linear|language_model.layers.5.self_attn.q_proj|39.self_attn.v_proj|38.self_attn.v_proj|language_model.layers.0.self_attn.v_proj|language_model.layers.17.self_attn.q_proj|language_model.layers.3.self_attn.k_proj|29.self_attn.k_proj|language_model.layers.26.self_attn.q_proj|language_model.layers.11.self_attn.k_proj|language_model.layers.24.self_attn.v_proj|language_model.layers.17.self_attn.v_proj|37.self_attn.q_proj|language_model.layers.22.self_attn.v_proj|language_model.layers.17.self_attn.k_proj|language_model.layers.21.self_attn.q_proj|30.self_attn.q_proj|language_model.layers.11.self_attn.q_proj|language_model.layers.8.self_attn.q_proj|language_model.layers.12.self_attn.v_proj|language_model.layers.20.self_attn.v_proj|32.self_attn.v_proj|31.self_attn.v_proj|language_model.layers.15.self_attn.q_proj
LoRA Alpha256
LoRA Dropout0.05
R Param256
Errorsreplace

Quantized Models of the Granite 4.0 3B Vision

Model
Likes
Downloads
VRAM
Granite 4.0 3B Vision 5bit1123 GB

Best Alternatives to Granite 4.0 3B Vision

Best Alternatives
Context / RAM
Downloads
Likes
...inistral 3 3B Glm Distillation256K / 7.7 GB971
Note: green Score (e.g. "73.2") means that the model is better than ibm-granite/granite-4.0-3b-vision.