DeepSeek V4 Flash W4A16 FP8 MTP is an open-source language model by canada-quant. Features: 50.7b LLM, VRAM: 170.4GB, Context: 1024K, License: mit, LLM Explorer Score: 0.29.
| LLM Name | DeepSeek V4 Flash W4A16 FP8 MTP |
| Repository 🤗 | https://huggingface.co/canada-quant/DeepSeek-V4-Flash-W4A16-FP8-MTP |
| Base Model(s) | |
| Model Size | 50.7b |
| Required VRAM | 170.4 GB |
| Updated | 2026-08-01 |
| Maintainer | canada-quant |
| Model Type | deepseek_v4 |
| Model Files | |
| Supported Languages | en zh |
| Model Architecture | DeepseekV4ForCausalLM |
| License | mit |
| Context Length | 1048576 |
| Model Max Length | 1048576 |
| Transformers Version | 5.8.1 |
| Tokenizer Class | TokenizersBackend |
| Padding Token | <|end▁of▁sentence|> |
| Vocabulary Size | 129280 |
| Torch Data Type | bfloat16 |