Qwen3.6 35B A3B GPTQ INT4 W4A16 LowLatency is an open-source language model by Twu31. Features: 35b LLM, VRAM: 19.3GB, License: apache-2.0, Quantized, LLM Explorer Score: 0.42, ELO: 1395.
| LLM Name | Qwen3.6 35B A3B GPTQ INT4 W4A16 LowLatency |
| Repository π€ | https://huggingface.co/Twu31/Qwen3.6-35B-A3B-GPTQ-INT4-W4A16-LowLatency |
| Base Model(s) | |
| Model Size | 35b |
| Required VRAM | 19.3 GB |
| Updated | 2026-08-20 |
| Maintainer | Twu31 |
| Model Type | qwen3_5_moe |
| Model Files | |
| Supported Languages | zh en |
| GPTQ Quantization | Yes |
| Quantization Type | gptq |
| Model Architecture | Qwen3_5MoeForConditionalGeneration |
| License | apache-2.0 |
| Model Max Length | 262144 |
| Transformers Version | 5.14.1 |
| Tokenizer Class | Qwen2Tokenizer |
| Padding Token | <|endoftext|> |
| Errors | replace |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| Qwen3.6 35B A3B GPTQ Int4 | 0K / 22.7 GB | 282964 | 29 |
| Qwen3.5 35B A3B GPTQ Int4 | 0K / 24.3 GB | 453653 | 92 |
| Qwen3.5 35B A3B GPTQ Int4 | 0K / 21.7 GB | 31 | 4 |
| Qwen3.6 35B A3B MLX 4bit | 0K / 20.5 GB | 513193 | 6 |
| Qwen3.6 35B A3B MLX 6bit | 0K / 28.9 GB | 478592 | 2 |
| Qwen3.6 35B A3B MLX 8bit | 0K / 37.8 GB | 473537 | 1 |
| Qwen3.6 35B A3B UD MLX 4bit | 0K / 21.6 GB | 15720 | 112 |
| Nail Qwen3.6 35B A3B MLX 5bit | 0K / 27.5 GB | 83 | 1 |
| Qwen3.6 35B A3B MLX 8bit | 0K / 37.8 GB | 3862 | 41 |
| Qwen3.6 35B A3B 6bit | 0K / 28.9 GB | 2742 | 8 |