DeepSeek V4.1 Flash MixedQ2 GGUF is an open-source language model by apetersson. Features: LLM, VRAM: 10.8GB, License: mit, Quantized.
| LLM Name | DeepSeek V4.1 Flash MixedQ2 GGUF |
| Repository 🤗 | https://huggingface.co/apetersson/DeepSeek-V4.1-Flash-MixedQ2-GGUF |
| Base Model(s) | |
| Required VRAM | 10.8 GB |
| Updated | 2026-09-13 |
| Maintainer | apetersson |
| Model Type | deepseek_v41 |
| Model Files | |
| GGUF Quantization | Yes |
| Quantization Type | gguf|q2 |
| Model Architecture | DeepseekV41ForCausalLM |
| License | mit |
| Model Max Length | 1048576 |
| Transformers Version | 5.6.0 |
| Tokenizer Class | PreTrainedTokenizerFast |
| Beginning of Sentence Token | <|begin▁of▁sentence|> |
| End of Sentence Token | <|end▁of▁sentence|> |