LLM EXPLORER 60,783 MODELS INDEXED

Llama Finetune 16bit Wiki 250 Ver2 GPTQ by obamaTeo

By obamaTeo · 5 downloads

Llama Finetune 16bit Wiki 250 Ver2 GPTQ is an open-source language model by obamaTeo. Features: 2b LLM, VRAM: 5.8GB, Context: 8K, Quantized, Fine-Tuned, LLM Explorer Score: 0.13.

  Arxiv:1910.09700   16bit   4-bit   Autotrain compatible   Conversational   Endpoints compatible   Finetuned   Gptq   Llama   Quantized   Region:us   Safetensors   Sharded   Tensorflow

Llama Finetune 16bit Wiki 250 Ver2 GPTQ Parameters and Internals

LLM NameLlama Finetune 16bit Wiki 250 Ver2 GPTQ
Repository πŸ€—https://huggingface.co/obamaTeo/llama-finetune-16bit-wiki-250-ver2-GPTQ 
Model Size2b
Required VRAM5.8 GB
Updated2025-08-18
MaintainerobamaTeo
Model Typellama
Model Files  4.7 GB: 1-of-2   1.1 GB: 2-of-2
GPTQ QuantizationYes
Quantization Typegptq|16bit
Model ArchitectureLlamaForCausalLM
Context Length8192
Model Max Length8192
Transformers Version4.41.2
Tokenizer ClassPreTrainedTokenizerFast
Padding Token<|reserved_special_token_250|>
Vocabulary Size128256
Torch Data Typefloat16

Best Alternatives to Llama Finetune 16bit Wiki 250 Ver2 GPTQ

Best Alternatives
Context / RAM
Downloads
Likes
MiniCPM5 2B GPTQ128K / 2.1 GB8213
MiniCPM5 2B MLX 8bit128K / 2.7 GB1933
MiniCPM5 2B MLX 4bit128K / 1.4 GB1162
MiniCPM5 2B MLX 6bit128K / 2 GB1921
...ll Slm 2B Safetensors Mlx 4Bit8K / 1 GB2674
MiniCPM5 2B Base512K / 5 GB5417
MiniCPM5 2B128K / 5 GB2879623
MiniCPM5 2B MLX128K / 1.4 GB28824
...iniCPM5 2B Heretic Abliterated128K / 5 GB5101
MiniCPM5 2B Midtrain128K / 5 GB5117
Note: green Score (e.g. "73.2") means that the model is better than obamaTeo/llama-finetune-16bit-wiki-250-ver2-GPTQ.