LLM EXPLORER 61,405 MODELS INDEXED

Qwen3.8 Flash Next MXFP4 FP8 GPTQ by tcclaviger

By tcclaviger · 172 downloads

Qwen3.8 Flash Next MXFP4 FP8 GPTQ is an open-source language model by tcclaviger. Features: 175.4b LLM, VRAM: 5.4GB, License: apache-2.0, Quantized, LLM Explorer Score: 0.35.

  8-bit   Amd Base model:quantized:qwen/qwen... Base model:qwen/qwen3.8-flash-...   Compressed-tensors   Conversational   Endpoints compatible   Gptq   Image-text-to-text   Mxfp4   Quantized   Qwen4 exp   R9700   Rdna4   Region:us   Safetensors

Qwen3.8 Flash Next MXFP4 FP8 GPTQ Parameters and Internals

LLM NameQwen3.8 Flash Next MXFP4 FP8 GPTQ
Repository πŸ€—https://huggingface.co/tcclaviger/Qwen3.8-Flash-Next-MXFP4-FP8-GPTQ 
Base Model(s)  Qwen/Qwen3.8-Flash-Next   Qwen/Qwen3.8-Flash-Next
Model Size175.4b
Required VRAM5.4 GB
Updated2026-09-16
Maintainertcclaviger
Model Typeqwen4_exp
Model Files  5.4 GB   5.5 GB   5.5 GB   5.5 GB   5.5 GB   5.5 GB   5.5 GB   5.5 GB   5.5 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   5.6 GB   0.0 GB
GPTQ QuantizationYes
Quantization Typegptq
Model ArchitectureQwen4ExpForConditionalGeneration
Licenseapache-2.0
Model Max Length262144
Transformers Version5.8.0.dev0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace