Llama 31 Hhrlhf Squad Rlhf Policy Model is an open-source language model by almorin. Features: 1b LLM, VRAM: 2.5GB, Context: 128K, Instruction-Based, LLM Explorer Score: 0.18.
| LLM Name | Llama 31 Hhrlhf Squad Rlhf Policy Model |
| Repository π€ | https://huggingface.co/almorin/llama-31-hhrlhf-squad-rlhf-policy-model |
| Model Size | 1b |
| Required VRAM | 2.5 GB |
| Updated | 2025-09-23 |
| Maintainer | almorin |
| Model Type | llama |
| Instruction-Based | Yes |
| Model Files | |
| Model Architecture | LlamaForCausalLM |
| Context Length | 131072 |
| Model Max Length | 131072 |
| Transformers Version | 4.44.0 |
| Tokenizer Class | PreTrainedTokenizerFast |
| Padding Token | <|eot_id|> |
| Vocabulary Size | 128256 |
| Torch Data Type | float16 |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| ...1B Claude Opus Fable5 Thinking | 128K / 2.2 GB | 6165 | 166 |
| Llama 3.2 1B Instruct | 128K / 2.5 GB | 212072 | 100 |
| Llama 3.2 1B Instruct | 128K / 2.5 GB | 10114634 | 1549 |
| LlaMa3.2 1B Instruct | 128K / 4.9 GB | 14 | 0 |
| Llama 3.2 Mavrick.Spark 1B | 128K / 2.5 GB | 394 | 2 |
| Llama 3.2 1B Instruct Bf16 | 128K / 2.5 GB | 510 | 5 |
| ...Claude Opus Fable5 V2 Thinking | 128K / 2.2 GB | 288 | 4 |
| Llama 3.2 1B Instruct | 128K / 2.5 GB | 20 | 0 |
| Type O1 Mini Instruct | 128K / 2.5 GB | 232 | 0 |
| ShaziLLM 1B | 128K / 2.2 GB | 186 | 0 |