LLM EXPLORER 56,604 MODELS INDEXED

ViLaSR by inclusionAI

By inclusionAI · 38 downloads

ViLaSR is an open-source language model by inclusionAI. Features: 7b LLM, VRAM: 16.7GB, Context: 125K, Instruction-Based, LLM Explorer Score: 0.19.

  Arxiv:2506.09965 Base model:finetune:qwen/qwen2... Base model:qwen/qwen2.5-vl-7b-...   Conversational Dataset:antresearchnlp/vilasr-...   En   Image-text-to-text   Instruct   Qwen2 5 vl   Region:us   Safetensors   Sharded   Tensorflow
Model Card on HF πŸ€—: https://huggingface.co/inclusionAI/ViLaSR 

ViLaSR Parameters and Internals

LLM NameViLaSR
Repository πŸ€—https://huggingface.co/inclusionAI/ViLaSR 
Base Model(s)  Qwen/Qwen2.5-VL-7B-Instruct   Qwen/Qwen2.5-VL-7B-Instruct
Model Size7b
Required VRAM16.7 GB
Updated2026-08-08
MaintainerinclusionAI
Model Typeqwen2_5_vl
Instruction-BasedYes
Model Files  4.3 GB: 1-of-4   5.0 GB: 2-of-4   5.0 GB: 3-of-4   2.4 GB: 4-of-4
Supported Languagesen
Model ArchitectureQwen2_5_VLForConditionalGeneration
Context Length128000
Model Max Length128000
Transformers Version4.51.1
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Vocabulary Size152064
Torch Data Typefloat32
Errorsreplace

Best Alternatives to ViLaSR

Best Alternatives
Context / RAM
Downloads
Likes
OmniLong Qwen2.5 VL 7B512K / 16.6 GB72
Qwen2.5 VL 7B Instruct FP4125K / 7.2 GB491653
Qwen2.5 VL 7B Instruct NVFP4125K / 7.2 GB809216
ZwZ 7B125K / 16.6 GB3210
Qwen2.5 VL 7B Instruct FP8125K / 10 GB10098
OlmOCR 2 7B 1025 Bf16125K / 16.6 GB1542
ScaleCUA 7B125K / 16.6 GB11511
HuatuoGPT Vision 7B Qwen2.5VL125K / 16.6 GB35811
Holo1 7B Bf16125K / 16.6 GB242
Qwen2.5 VL 7B Instruct Bf16125K / 16.6 GB1603
Note: green Score (e.g. "73.2") means that the model is better than inclusionAI/ViLaSR.