Ornith 1.5 35B A3B GPTQ Int4 Sym G128 MTP BF16 MixedCal V2 is an open-source language model by SergiioB. Features: 35b LLM, VRAM: 24.4GB, License: apache-2.0, Quantized, LLM Explorer Score: 0.3.
| LLM Name | Ornith 1.5 35B A3B GPTQ Int4 Sym G128 MTP BF16 MixedCal V2 |
| Repository π€ | https://huggingface.co/SergiioB/Ornith-1.5-35B-A3B-GPTQ-Int4-sym-G128-MTP-BF16-MixedCal-v2 |
| Base Model(s) | |
| Model Size | 35b |
| Required VRAM | 24.4 GB |
| Updated | 2026-08-23 |
| Maintainer | SergiioB |
| Model Type | qwen3_5_moe |
| Model Files | |
| GPTQ Quantization | Yes |
| Quantization Type | gptq |
| Model Architecture | Qwen3_5MoeForConditionalGeneration |
| License | apache-2.0 |
| Model Max Length | 262144 |
| Transformers Version | 5.15.0 |
| Tokenizer Class | Qwen2TokenizerFast |
| Padding Token | <|endoftext|> |
| Errors | replace |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| Qwen3.6 35B A3B GPTQ Int4 | 0K / 22.7 GB | 282964 | 29 |
| ...A3B GPTQ INT4 W4A16 LowLatency | 0K / 19.3 GB | 19 | 1 |
| Qwen3.5 35B A3B GPTQ Int4 | 0K / 24.3 GB | 453653 | 92 |
| Qwen3.5 35B A3B GPTQ Int4 | 0K / 21.7 GB | 31 | 4 |
| Qwen3.6 35B A3B MLX 4bit | 0K / 20.5 GB | 513193 | 6 |
| Qwen3.6 35B A3B MLX 6bit | 0K / 28.9 GB | 478592 | 2 |
| Qwen3.6 35B A3B MLX 8bit | 0K / 37.8 GB | 473537 | 1 |
| Qwen3.6 35B A3B UD MLX 4bit | 0K / 21.6 GB | 15720 | 112 |
| Qwen3.6 35B A3B MLX 8bit | 0K / 37.8 GB | 3862 | 41 |
| Nail Qwen3.6 35B A3B MLX 5bit | 0K / 27.5 GB | 83 | 1 |