Nanbeige 16B Chat GGUF is an open-source language model by TheBloke. Features: 16b LLM, VRAM: 6.6GB, License: apache-2.0, Quantized, LLM Explorer Score: 0.1.
| Model Type |
| ||||||||||||
| Use Cases |
| ||||||||||||
| Additional Notes |
| ||||||||||||
| Supported Languages |
| ||||||||||||
| Training Details |
| ||||||||||||
| Safety Evaluation |
| ||||||||||||
| Input Output |
|
| LLM Name | Nanbeige 16B Chat GGUF |
| Repository π€ | https://huggingface.co/TheBloke/Nanbeige-16B-Chat-GGUF |
| Model Name | Nanbeige 16B Chat |
| Model Creator | Nanbeige LLM Lab |
| Base Model(s) | |
| Model Size | 16b |
| Required VRAM | 6.6 GB |
| Updated | 2026-07-29 |
| Maintainer | TheBloke |
| Model Type | nanbeige |
| Model Files | |
| Supported Languages | en zh |
| GGUF Quantization | Yes |
| Quantization Type | gguf |
| Model Architecture | AutoModel |
| License | apache-2.0 |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| Tinyllama Gguf 16B | 0K / 2.2 GB | 17 | 0 |
| Llama 3 16B Instruct V0.1 GGUF | 0K / 6.4 GB | 502 | 9 |
| Nanbeige 16B Chat 32K GGUF | 0K / 6.6 GB | 566 | 6 |
| Nanbeige 16B Base 32K GGUF | 0K / 6.6 GB | 352 | 4 |
| Nanbeige 16B Base GGUF | 0K / 6.6 GB | 200 | 1 |
| Ct2fast Codegen2 16B | 0K / 32.1 GB | 0 | 1 |
| Ct2fast Codegen 16B Mono | 0K / 32.1 GB | 1 | 2 |