Qwen3 Next 80B A3B Thinking NVFP4 is an open-source language model by nvidia. Features: 80b LLM, VRAM: 50.7GB, Context: 256K, License: apache-2.0, LLM Explorer Score: 0.25.
| LLM Name | Qwen3 Next 80B A3B Thinking NVFP4 |
| Repository π€ | https://huggingface.co/nvidia/Qwen3-Next-80B-A3B-Thinking-NVFP4 |
| Base Model(s) | |
| Model Size | 80b |
| Required VRAM | 50.7 GB |
| Updated | 2026-07-21 |
| Maintainer | nvidia |
| Model Type | qwen3_next |
| Model Files | |
| Model Architecture | Qwen3NextForCausalLM |
| License | apache-2.0 |
| Context Length | 262144 |
| Model Max Length | 262144 |
| Transformers Version | 4.57.1 |
| Tokenizer Class | Qwen2Tokenizer |
| Padding Token | <|im_end|> |
| Vocabulary Size | 151936 |
| Errors | replace |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| Qwen3 Next 80B A3B Instruct | 256K / 162.7 GB | 422 | 89 |
| Qwen3 Next 80B A3B Thinking | 256K / 162.7 GB | 100 | 7 |
| Qwen3 Next 80B A3B Instruct | 256K / 162.7 GB | 286679 | 1042 |
| ...wen3 Next 80B A3B Instruct FP8 | 256K / 81.8 GB | 329583 | 89 |
| Qwen3 Next 80B A3B Thinking | 256K / 162.7 GB | 35946 | 492 |
| Qwen3 Next MoE | 256K / 0 GB | 127090 | 4 |
| ...n3 Next 80B A3B Instruct NVFP4 | 256K / 50.7 GB | 13898 | 39 |
| ...wen3 Next 80B A3B Thinking FP8 | 256K / 81.8 GB | 20135 | 54 |
| ...t 80B A3B Instruct FP8 Dynamic | 256K / 80.5 GB | 506 | 4 |
| ...ext 80B A3B Instruct Mxfp4 Mlx | 256K / 42 GB | 243 | 8 |