Llama Finetune 16bit Wiki 250 Ver2 GPTQ is an open-source language model by obamaTeo. Features: 2b LLM, VRAM: 5.8GB, Context: 8K, Quantized, Fine-Tuned, LLM Explorer Score: 0.13.
| LLM Name | Llama Finetune 16bit Wiki 250 Ver2 GPTQ |
| Repository π€ | https://huggingface.co/obamaTeo/llama-finetune-16bit-wiki-250-ver2-GPTQ |
| Model Size | 2b |
| Required VRAM | 5.8 GB |
| Updated | 2025-08-18 |
| Maintainer | obamaTeo |
| Model Type | llama |
| Model Files | |
| GPTQ Quantization | Yes |
| Quantization Type | gptq|16bit |
| Model Architecture | LlamaForCausalLM |
| Context Length | 8192 |
| Model Max Length | 8192 |
| Transformers Version | 4.41.2 |
| Tokenizer Class | PreTrainedTokenizerFast |
| Padding Token | <|reserved_special_token_250|> |
| Vocabulary Size | 128256 |
| Torch Data Type | float16 |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| MiniCPM5 2B GPTQ | 128K / 2.1 GB | 82 | 13 |
| MiniCPM5 2B MLX 8bit | 128K / 2.7 GB | 193 | 3 |
| MiniCPM5 2B MLX 4bit | 128K / 1.4 GB | 116 | 2 |
| MiniCPM5 2B MLX 6bit | 128K / 2 GB | 192 | 1 |
| ...ll Slm 2B Safetensors Mlx 4Bit | 8K / 1 GB | 267 | 4 |
| MiniCPM5 2B Base | 512K / 5 GB | 54 | 17 |
| MiniCPM5 2B | 128K / 5 GB | 2879 | 623 |
| MiniCPM5 2B MLX | 128K / 1.4 GB | 288 | 24 |
| ...iniCPM5 2B Heretic Abliterated | 128K / 5 GB | 510 | 1 |
| MiniCPM5 2B Midtrain | 128K / 5 GB | 51 | 17 |