Qwen3 1.7B Gsm8k Sft is an open-source language model by HuggingFaceTB. Features: 1.7b LLM, VRAM: 1.8GB, Context: 40K, License: apache-2.0, Quantized, LLM Explorer Score: 0.25.
| LLM Name | Qwen3 1.7B Gsm8k Sft |
| Repository π€ | https://huggingface.co/HuggingFaceTB/qwen3-1.7b-gsm8k-sft |
| Base Model(s) | |
| Model Size | 1.7b |
| Required VRAM | 1.8 GB |
| Updated | 2026-08-09 |
| Maintainer | HuggingFaceTB |
| Model Type | qwen3 |
| Model Files | |
| Supported Languages | en |
| GGUF Quantization | Yes |
| Quantization Type | gguf|q8 |
| Model Architecture | Qwen3ForCausalLM |
| License | apache-2.0 |
| Context Length | 40960 |
| Model Max Length | 40960 |
| Transformers Version | 4.57.6 |
| Tokenizer Class | Qwen2Tokenizer |
| Padding Token | <|endoftext|> |
| Vocabulary Size | 151936 |
| Errors | replace |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| Nanomind Security Analyst | 40K / 1.1 GB | 564 | 4 |
| Qwen3 1.7B GGUF | 40K / 0.5 GB | 39955 | 69 |
| ... Deepseek R1 0528 Distillation | 40K / 4 GB | 167 | 3 |
| Qwen3 1.7B Mixture Of Thought | 40K / 4 GB | 114 | 3 |
| Qwen3 1.7B MLX 4bit | 64K / 0.9 GB | 868 | 4 |
| Distill 1.7B 4bit MLX | 40K / 1.1 GB | 179 | 0 |
| Qwen3 1.7B Unsloth Bnb 4bit | 40K / 1.4 GB | 53710 | 12 |
| Qwen3 1.7B 4bit | 40K / 1 GB | 14082 | 6 |
| Qwen3 1.7B Bnb 4bit | 40K / 1.4 GB | 3227 | 5 |
| Qwen3 1.7B 4bit DWQ 053125 | 40K / 1 GB | 596 | 2 |