LLM EXPLORER 60,147 MODELS INDEXED

Qwen3.8 Flash Next W4A16 by VnimanieAI

By VnimanieAI · 6043 downloads

Qwen3.8 Flash Next W4A16 is an open-source language model by VnimanieAI. Features: 180b LLM, VRAM: 0.5GB, License: other, LLM Explorer Score: 0.4.

  4-bit   Ampere Base model:quantized:qwen/qwen... Base model:qwen/qwen3.8-flash-...   Compressed-tensors   Conversational   Endpoints compatible   Image-text-to-text   Int4   Qwen4 exp   Region:us   Rtx-3090   Safetensors   Vllm   W4a16

Qwen3.8 Flash Next W4A16 Parameters and Internals

LLM NameQwen3.8 Flash Next W4A16
Repository πŸ€—https://huggingface.co/VnimanieAI/Qwen3.8-Flash-Next-W4A16 
Base Model(s)  Qwen/Qwen3.8-Flash-Next   Qwen/Qwen3.8-Flash-Next
Model Size180b
Required VRAM0.5 GB
Updated2026-09-01
MaintainerVnimanieAI
Model Typeqwen4_exp
Model Files  5.5 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   6.4 GB   4.9 GB   6.6 GB   7.0 GB   5.4 GB   5.9 GB   6.6 GB   7.0 GB   6.3 GB   6.5 GB   6.4 GB   6.6 GB   7.4 GB   1.3 GB   0.5 GB
Model ArchitectureQwen4ExpForConditionalGeneration
Licenseother
Model Max Length262144
Transformers Version5.8.0.dev0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace

Best Alternatives to Qwen3.8 Flash Next W4A16

Best Alternatives
Context / RAM
Downloads
Likes
Qwen3.8 Flash Next0K / 129.5 GB48103918
Qwen3.8 Flash Next FP80K / 65.7 GB2219117
Qwen3.8 Flash Next FP80K / 65.7 GB18530
Qwen3.8 Flash Next W4A160K / 0.5 GB5416
...3.8 Flash Next ABLITERATED FP80K / 64.7 GB2546
Qwen3.8 Flash Next0K / 129.5 GB8810
...Qwen3.8 Flash Next Abliterated0K / 124.3 GB643
...en3.8 Flash Next DERISKED BF160K / 129.5 GB792
...Next Abliterated FP8 DGX Spark0K / 61.9 GB742
Qwen3.8 Flash Next0K / 129.5 GB191
Note: green Score (e.g. "73.2") means that the model is better than VnimanieAI/Qwen3.8-Flash-Next-W4A16.