LLM EXPLORER 60,645 MODELS INDEXED

Nimue 8B Merged by manbeast3b

By manbeast3b · 6 downloads

Nimue 8B Merged is an open-source language model by manbeast3b. Features: 8b LLM, VRAM: 5.8GB, Context: 8K, License: other, Quantized, Instruction-Based, LLM Explorer Score: 0.15, Arc: 60.8, HellaSwag: 78.6, MMLU: 67.1, GSM8K: 68.7.

  4bit   8-bit Base model:finetune:meta-llama... Base model:meta-llama/meta-lla...   Conversational   Dataset:allenai/uncommonsense Dataset:athirdpath/dpo pairs-r... Dataset:clericalaid/roleplay-s... Dataset:fnlp/character-llm-dat...   Dataset:ilyagusev/pippa scored   En   Instruct   Llama   Llama-3   Quantized   Region:us   Safetensors   Sharded   Tensorflow

Nimue 8B Merged Parameters and Internals

LLM NameNimue 8B Merged
Repository πŸ€—https://huggingface.co/manbeast3b/Nimue-8B-merged 
Base Model(s)  Meta Llama 3 8B Instruct   meta-llama/Meta-Llama-3-8B-Instruct
Model Size8b
Required VRAM5.8 GB
Updated2026-08-07
Maintainermanbeast3b
Model Typellama
Instruction-BasedYes
Model Files  4.7 GB: 1-of-2   1.1 GB: 2-of-2
Supported Languagesen
Quantization Type4bit
Model ArchitectureLlamaForCausalLM
Licenseother
Context Length8192
Model Max Length8192
Transformers Version4.45.0.dev0
Tokenizer ClassPreTrainedTokenizerFast
Padding Token<|end_of_text|>
Vocabulary Size128256
Torch Data Typefloat16

Best Alternatives to Nimue 8B Merged

Best Alternatives
Context / RAM
Downloads
Likes
...B Instruct Gradient 1048K 4bit1024K / 4.5 GB102
...B Instruct Gradient 1048K 8bit1024K / 8.6 GB111
...truct Gradient 1048K Bpw6 EXL21024K / 6.7 GB22
...truct Gradient 1048K Bpw5 EXL21024K / 5.8 GB50
Llama 3 8B Instruct 1048K 4bit1024K / 4.5 GB52525
Llama 3 8B Instruct 1048K 8bit1024K / 8.6 GB21317
... Gradient 1048K 8.0bpw H8 EXL21024K / 8.6 GB23
...ct Gradient 1048K Bpw2.25 EXL21024K / 3.4 GB51
Llama 3 8B Instruct 262K 2bit256K / 2.5 GB111
...B Instruct 262k V2 EXL2 5.0bpw256K / 5.8 GB51