LLM EXPLORER 63,791 MODELS INDEXED

Consensuslab Peer Deference Agreement Qwen2.5 3B Grpo Lora by tanny2109

By tanny2109 · 12 downloads

Consensuslab Peer Deference Agreement Qwen2.5 3B Grpo Lora is an open-source language model by tanny2109. Features: 3b LLM, Instruction-Based, LLM Explorer Score: 0.27.

  Adapter   Alignment Base model:adapter:qwen/qwen2.... Base model:qwen/qwen2.5-3b-ins...   Conversational   Finetuned   Grpo   Instruct   Lora   Peft   Region:us   Research   Safetensors   Trl

Consensuslab Peer Deference Agreement Qwen2.5 3B Grpo Lora Parameters and Internals

LLM NameConsensuslab Peer Deference Agreement Qwen2.5 3B Grpo Lora
Repository πŸ€—https://huggingface.co/tanny2109/consensuslab-peer-deference-agreement-qwen2.5-3b-grpo-lora 
Base Model(s)  Qwen/Qwen2.5-3B-Instruct   Qwen/Qwen2.5-3B-Instruct
Model Size3b
Required VRAM0 GB
Updated2026-10-11
Maintainertanny2109
Instruction-BasedYes
Model Files  0.0 GB   0.0 GB
Model ArchitectureAdapter
Model Max Length131072
Is Biasednone
Tokenizer ClassQwen2Tokenizer
Padding Token<|im_end|>
PEFT TypeLORA
LoRA ModelYes
PEFT Target Modulesk_proj|v_proj|q_proj|o_proj
LoRA Alpha16
LoRA Dropout0
R Param8
Errorsreplace

Best Alternatives to Consensuslab Peer Deference Agreement Qwen2.5 3B Grpo Lora

Best Alternatives
Context / RAM
Downloads
Likes
AIBio LoRA0K / 0.1 GB281
StandardOne 3B LoRA0K / 0.1 GB421
... Checking Qwen2.5 3B Grpo Lora0K / 0 GB90
Qwen2.5 VL 3B FakeBench LoRA0K / 0.1 GB191
Talvion Support Sft Kb V2 Lora0K / 0.1 GB100
...2.5 3B Instruct Sheldon SFT V20K / 0.2 GB91
Running Coach Qwen3b Lora0K / 0.1 GB271
...wen2.5 Vl 3B Food Extract Lora0K / 0.1 GB151
Qwen Darija Domain Adapted0K / 0.1 GB131
Qwen Mom Generator0K / 0.1 GB111
Note: green Score (e.g. "73.2") means that the model is better than tanny2109/consensuslab-peer-deference-agreement-qwen2.5-3b-grpo-lora.