LLM EXPLORER 59,962 MODELS INDEXED

Qwen2.5 3B Sft 10 by CriteriaPO

By CriteriaPO · 19 downloads

Qwen2.5 3B Sft 10 is an open-source language model by CriteriaPO. Features: 3b LLM, VRAM: 6.2GB, Context: 32K, LLM Explorer Score: 0.18.

Base model:finetune:qwen/qwen2...   Base model:qwen/qwen2.5-3b   Conversational   Endpoints compatible   Generated from trainer   Qwen2   Region:us   Safetensors   Sft   Sharded   Tensorflow   Trl

Qwen2.5 3B Sft 10 Parameters and Internals

LLM NameQwen2.5 3B Sft 10
Repository πŸ€—https://huggingface.co/CriteriaPO/qwen2.5-3b-sft-10 
Model Nameqwen2.5-3b-sft-10
Base Model(s)  Qwen/Qwen2.5-3B   Qwen/Qwen2.5-3B
Model Size3b
Required VRAM6.2 GB
Updated2026-08-31
MaintainerCriteriaPO
Model Typeqwen2
Model Files  5.0 GB: 1-of-2   1.2 GB: 2-of-2   0.0 GB
Model ArchitectureQwen2ForCausalLM
Context Length32768
Model Max Length32768
Transformers Version4.46.3
Tokenizer ClassQwen2Tokenizer
Padding Token<|im_end|>
Vocabulary Size151665
Torch Data Typebfloat16
Errorsreplace

Best Alternatives to Qwen2.5 3B Sft 10

Best Alternatives
Context / RAM
Downloads
Likes
VibeThinker 3B128K / 6.2 GB52745806
Ulam 1 Small128K / 6.2 GB2024
VibeThinker 3B128K / 6.2 GB3610
...ibeThinker 3B SFT Fable5 Glint128K / 6.2 GB650
Saba1.5 Pro 3B128K / 5.8 GB91
...b Sft Stage1.2 Ss1 Expert Math128K / 15.1 GB120
... Formattedtext Math Wiki Merge128K / 15.1 GB120
...2 Ss1 Expert Fictional Lyrical128K / 15.1 GB60
...tage1.1 Ss1 With Math.no Issue128K / 15.1 GB60
...ware Howto Formattedtext Merge128K / 15.1 GB50
Note: green Score (e.g. "73.2") means that the model is better than CriteriaPO/qwen2.5-3b-sft-10.