LLM EXPLORER 61,135 MODELS INDEXED

Vilaw Llm DPO by breakdown881

By breakdown881 · 17 downloads

Vilaw Llm DPO is an open-source language model by breakdown881. Features: 7b LLM, VRAM: 0.2GB, License: apache-2.0, Instruction-Based, LLM Explorer Score: 0.29.

  Adapter Base model:adapter:qwen/qwen2.... Base model:qwen/qwen2.5-7b-ins...   Conversational   Dataset:ntphuc149/vibidlqa v1 Dataset:thangvip/vietnamese-le...   Dpo   Finetuned   Instruct   Legal   Legal-reasoning   Lora   Peft   Qlora   Region:us   Safetensors   Synthetic-data   Trl   Unsloth   Vi   Vietnamese

Vilaw Llm DPO Parameters and Internals

LLM NameVilaw Llm DPO
Repository πŸ€—https://huggingface.co/breakdown881/vilaw-llm-dpo 
Base Model(s)  Qwen/Qwen2.5-7B-Instruct   Qwen/Qwen2.5-7B-Instruct
Model Size7b
Required VRAM0.2 GB
Updated2026-09-14
Maintainerbreakdown881
Instruction-BasedYes
Model Files  0.2 GB
Supported Languagesvi
Model ArchitectureAdapter
Licenseapache-2.0
Is Biasednone
Tokenizer ClassQwen2Tokenizer
Padding Token<|vision_pad|>
PEFT TypeLORA
LoRA ModelYes
PEFT Target Modulesk_proj|up_proj|q_proj|down_proj|v_proj|gate_proj|o_proj
LoRA Alpha32
LoRA Dropout0
R Param16

Best Alternatives to Vilaw Llm DPO

Best Alternatives
Context / RAM
Downloads
Likes
Zduhac Cyber 7B V20K / 0 GB81
Llama2 7B Qlora Guanaco0K / 0.1 GB111
Qwen Megumin0K / 0.1 GB111
Mistral 7B Instruct Vi Alpaca0K / 0.4 GB50
Vietnamese Amr Baseline 7B0K / 0 GB130
Mistral 7B Instruct Sa V0.10K / 0 GB90
Deepthink Reasoning Adapter0K / 0.2 GB163
Qwen2.5 7b NotesCorrector0K / 0.6 GB100
Mistral 7B Selfplay V00K / 0.2 GB50
Mistral 7B V2 Selfplay0K / 0.2 GB70