LLM EXPLORER 63,407 MODELS INDEXED

Qwen3.8 Flash Next NVFP4 by RedHatAI

By RedHatAI · 1503 downloads

Qwen3.8 Flash Next NVFP4 is an open-source language model by RedHatAI. Features: 180b LLM, VRAM: 180.8GB, LLM Explorer Score: 0.32.

  8-bit Base model:quantized:qwen/qwen... Base model:qwen/qwen3.8-flash-...   Compressed-tensors   Conversational   Endpoints compatible   Fp4   Image-text-to-text   Llm-compressor   Nvfp4   Qwen4 exp   Region:us   Safetensors   Sharded   Tensorflow   Vllm

Qwen3.8 Flash Next NVFP4 Parameters and Internals

LLM NameQwen3.8 Flash Next NVFP4
Repository πŸ€—https://huggingface.co/RedHatAI/Qwen3.8-Flash-Next-NVFP4 
Base Model(s)  Qwen/Qwen3.8-Flash-Next   Qwen/Qwen3.8-Flash-Next
Model Size180b
Required VRAM180.8 GB
Updated2026-10-08
MaintainerRedHatAI
Model Typeqwen4_exp
Model Files  102.0 GB: 1-of-5   20.0 GB: 2-of-5   20.0 GB: 3-of-5   20.0 GB: 4-of-5   18.8 GB: 5-of-5   5.2 GB
Model ArchitectureQwen4ExpForConditionalGeneration
Model Max Length262144
Transformers Version5.16.1
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace

Best Alternatives to Qwen3.8 Flash Next NVFP4

Best Alternatives
Context / RAM
Downloads
Likes
Qwen3.8 Flash Next0K / 129.5 GB48103918
Darwin 180B RSI0K / 119 GB35394
...Qwen3.8 Flash Next Abliterated0K / 129.5 GB49342
Qwen3.8 Flash Next FP80K / 65.7 GB2219117
Tinfield 10K / 129.5 GB57741
CYBER FROST 3.8 BF160K / 124.3 GB114146
Qwen3.8 Flash Next W4A160K / 0.5 GB604322
Darwin 180B RSI R30K / 127.7 GB1517
CYBER FROST 3.8 FP80K / 63 GB994
Qwen3.8 Flash Next FP80K / 65.7 GB18530
Note: green Score (e.g. "73.2") means that the model is better than RedHatAI/Qwen3.8-Flash-Next-NVFP4.