LLM EXPLORER 60,062 MODELS INDEXED

Qwen35 4B Winner V2 DPO by Sarim-Hash

By Sarim-Hash · 30 downloads

Qwen35 4B Winner V2 DPO is an open-source language model by Sarim-Hash. Features: 4b LLM, VRAM: 9.1GB, LLM Explorer Score: 0.28.

Base model:finetune:sarim-hash... Base model:sarim-hash/qwen35-4...   Conversational   Debate   Dpo   Endpoints compatible   Full-finetune   Image-text-to-text   Qwen3 5   Region:us   Safetensors

Qwen35 4B Winner V2 DPO Parameters and Internals

LLM NameQwen35 4B Winner V2 DPO
Repository πŸ€—https://huggingface.co/Sarim-Hash/qwen35-4b-winner-v2-dpo 
Base Model(s)  Qwen35 4B Sft V2   Sarim-Hash/qwen35-4b-sft-v2
Model Size4b
Required VRAM9.1 GB
Updated2026-08-31
MaintainerSarim-Hash
Model Typeqwen3_5
Model Files  9.1 GB   0.0 GB
Model ArchitectureQwen3_5ForConditionalGeneration
Model Max Length262144
Transformers Version5.8.0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace

Best Alternatives to Qwen35 4B Winner V2 DPO

Best Alternatives
Context / RAM
Downloads
Likes
Qwen3.5 4B0K / 9.3 GB6575502801
NuExtract30K / 0.2 GB441570324
Agents A1 4B0K / 9.1 GB17757872
Qwen3.8 4B Distill0K / 9.3 GB187826
Qwen3.5 4B Base0K / 9.3 GB22781479
Fara1.5 4B0K / 9.1 GB493439
ASL 4B V10K / 9.3 GB11911
Qwen3.5 4B Finnish0K / 9.1 GB3301
Qwen35 4b Sft VE0K / 9.1 GB36630
Qwen3.5 4B0K / 9.3 GB13996126
Note: green Score (e.g. "73.2") means that the model is better than Sarim-Hash/qwen35-4b-winner-v2-dpo.