Qwen3 VL 8B Thinking 8bit is an open-source language model by mlx-community. Features: 8b LLM, VRAM: 9.8GB, License: apache-2.0, Quantized, LLM Explorer Score: 0.21.
| LLM Name | Qwen3 VL 8B Thinking 8bit |
| Repository π€ | https://huggingface.co/mlx-community/Qwen3-VL-8B-Thinking-8bit |
| Model Size | 8b |
| Required VRAM | 9.8 GB |
| Updated | 2026-08-08 |
| Maintainer | mlx-community |
| Model Type | qwen3_vl |
| Model Files | |
| Quantization Type | 8bit |
| Model Architecture | Qwen3VLForConditionalGeneration |
| License | apache-2.0 |
| Model Max Length | 262144 |
| Transformers Version | 4.57.0 |
| Padding Token | <|endoftext|> |
| Errors | replace |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| ...L 8B Instruct Unsloth Bnb 4bit | 0K / 7.7 GB | 24231 | 22 |
| Qwen3 VL 8B Instruct 4bit | 0K / 5.7 GB | 2365 | 6 |
| ...Vl 2 8B Thinking 2603 MLX 8bit | 0K / 9.8 GB | 7 | 1 |
| Qwen3 VL 8B Instruct 8bit | 0K / 9.8 GB | 1157 | 5 |
| Qwen3 VL 8B Instruct 6bit | 0K / 7.8 GB | 44 | 2 |
| Qwen3 VL 8B Thinking 6bit | 0K / 7.8 GB | 26 | 1 |
| Qwen3 VL 8B Instruct | 0K / 17.5 GB | 4494329 | 1037 |
| Holo2 8B | 0K / 17.5 GB | 1924 | 30 |
| Qwen3 VL 8B Instruct FP8 | 0K / 10.6 GB | 3108604 | 77 |
| Qwen3 VL 8B Instruct AWQ 4bit | 0K / 7.5 GB | 408618 | 16 |