LLM EXPLORER 61,491 MODELS INDEXED

Qwen3 1.7B Coder Distilled SFT by reaperdoesntknow

By reaperdoesntknow · 3919 downloads

Qwen3 1.7B Coder Distilled SFT is an open-source language model by reaperdoesntknow. Features: 1.7b LLM, VRAM: 4.1GB, Context: 40K, License: apache-2.0, Code Generating, LLM Explorer Score: 0.27.

Base model:finetune:qwen/qwen3...   Base model:qwen/qwen3-1.7b   Chain-of-thought   Code   Codegen   Convergentintel   Conversational Dataset:0xzee/dataset-cot-adva... Dataset:0xzee/dataset-cot-clas... Dataset:0xzee/dataset-cot-diff... Dataset:0xzee/dataset-cot-elec... Dataset:0xzee/dataset-cot-engi... Dataset:0xzee/dataset-cot-line... Dataset:0xzee/dataset-cot-math... Dataset:0xzee/dataset-cot-mode... Dataset:0xzee/dataset-cot-mole... Dataset:0xzee/dataset-cot-phys... Dataset:0xzee/dataset-cot-phys... Dataset:0xzee/dataset-cot-theo... Dataset:konstantindob/logic in...   Distillation   Edge   En   Endpoints compatible   Engineering   Knowledge-distillation   Logic   Logical-inference   Mathematics   Physics   Qwen3   Reasoning   Region:us   Safetensors   Sft   Stem

Qwen3 1.7B Coder Distilled SFT Parameters and Internals

LLM NameQwen3 1.7B Coder Distilled SFT
Repository πŸ€—https://huggingface.co/reaperdoesntknow/Qwen3-1.7B-Coder-Distilled-SFT 
Base Model(s)  Qwen/Qwen3-1.7B   Qwen/Qwen3-1.7B
Model Size1.7b
Required VRAM4.1 GB
Updated2026-09-17
Maintainerreaperdoesntknow
Model Typeqwen3
Model Files  4.1 GB
Supported Languagesen
Generates CodeYes
Model ArchitectureQwen3ForCausalLM
Licenseapache-2.0
Context Length40960
Model Max Length40960
Transformers Version5.0.0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Vocabulary Size151936
Errorsreplace

Best Alternatives to Qwen3 1.7B Coder Distilled SFT

Best Alternatives
Context / RAM
Downloads
Likes
FluentlyQwen3 Coder 1.7B40K / 4.1 GB51
...ruct Fast CODER Reasoning 2.4B40K / 9.7 GB91
... Instruct CODER Reasoning 2.7B40K / 11 GB80