LLM EXPLORER 61,405 MODELS INDEXED

Qwen3 0.6B GPTQ Int8 by Qwen

By Qwen · 749 downloads

Qwen3 0.6B GPTQ Int8 is an open-source language model by Qwen. Features: 0.6b LLM, VRAM: 0.8GB, Context: 40K, License: apache-2.0, Quantized, LLM Explorer Score: 0.19.

  Arxiv:2505.09388   8-bit Base model:quantized:qwen/qwen...   Base model:qwen/qwen3-0.6b   Conversational   Endpoints compatible   Gptq   Quantized   Qwen3   Region:us   Safetensors

Qwen3 0.6B GPTQ Int8 Parameters and Internals

LLM NameQwen3 0.6B GPTQ Int8
Repository πŸ€—https://huggingface.co/Qwen/Qwen3-0.6B-GPTQ-Int8 
Base Model(s)  Qwen/Qwen3-0.6B   Qwen/Qwen3-0.6B
Model Size0.6b
Required VRAM0.8 GB
Updated2026-07-06
MaintainerQwen
Model Typeqwen3
Model Files  0.8 GB
GPTQ QuantizationYes
Quantization Typegptq
Model ArchitectureQwen3ForCausalLM
Licenseapache-2.0
Context Length40960
Model Max Length40960
Transformers Version4.51.3
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Vocabulary Size151936
Torch Data Typefloat16
Errorsreplace

Best Alternatives to Qwen3 0.6B GPTQ Int8

Best Alternatives
Context / RAM
Downloads
Likes
Agent 0.6B125K / 1.2 GB140
Fizik 0.6B Preview40K / 1.2 GB90
Qwen3 0.6B Unsloth Bnb 4bit40K / 0.6 GB14692025
Qwen3 0.6B 4bit40K / 0.3 GB5031514
Qwentestnew140K / 1.2 GB660
Qwen3 0.6B 8bit40K / 0.6 GB413187
Qwen3 0.6B SFTchat Math40K / 1.2 GB150
Meet7 0.6B40K / 1.2 GB101
...d Qwen3 0.6B Gabliterated 4bit40K / 0.3 GB241
Qwen3 0.6B Gabliterated 4bit40K / 0.3 GB61
Note: green Score (e.g. "73.2") means that the model is better than Qwen/Qwen3-0.6B-GPTQ-Int8.