Qwen3.5 4B INT8 is an open-source language model by AxisQuant. Features: 4b LLM, VRAM: 4.8GB, Context: 256K, License: apache-2.0, LLM Explorer Score: 0.25.
| LLM Name | Qwen3.5 4B INT8 |
| Repository π€ | https://huggingface.co/AxisQuant/Qwen3.5-4B-INT8 |
| Base Model(s) | |
| Model Size | 4b |
| Required VRAM | 4.8 GB |
| Updated | 2026-08-11 |
| Maintainer | AxisQuant |
| Model Type | qwen3_5_text |
| Model Files | |
| Supported Languages | en |
| Model Architecture | Qwen3_5ForCausalLM |
| License | apache-2.0 |
| Context Length | 262144 |
| Model Max Length | 262144 |
| Transformers Version | 5.7.0 |
| Tokenizer Class | Qwen2Tokenizer |
| Padding Token | <|endoftext|> |
| Vocabulary Size | 248320 |
| Errors | replace |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| Agents A1 4B Fable Preview | 256K / 8.4 GB | 103 | 0 |
| ...ts A1 4B Fable Preview Heretic | 256K / 8.4 GB | 2285 | 2 |
| Qwen35 4B T13 Opd Rkl Ckpt50 | 256K / 8.4 GB | 467 | 0 |
| Zira Researcher | 256K / 8.4 GB | 11404 | 12 |
| ...nts A1 4B Kimi Preview Heretic | 256K / 8.4 GB | 287 | 0 |
| Qwen3.5 4B EU | 256K / 9.7 GB | 87 | 0 |
| Qwen35 4B Soyuz Merged | 256K / 8.4 GB | 73 | 3 |
| Retrico Lm 4B Finetuned V4 | 256K / 0 GB | 143 | 0 |
| Holo 3.1 4B Coder | 256K / 16.8 GB | 41 | 1 |
| Qwen3.5 4B INT8 | 256K / 4.8 GB | 111 | 2 |