LLM EXPLORER 59,766 MODELS INDEXED

Qwen3 4B DFlash B16 by z-lab

By z-lab · 23296 downloads

Qwen3 4B DFlash B16 is an open-source language model by z-lab. Features: 4b LLM, VRAM: 1.1GB, Context: 40K, License: mit, LLM Explorer Score: 0.28.

  Arxiv:2602.06036   Custom code   Dflash   Diffusion   Diffusion-language-model   Efficiency   Endpoints compatible   Feature-extraction   Flash-decoding   Qwen   Qwen3   Region:us   Safetensors   Speculative-decoding

Qwen3 4B DFlash B16 Parameters and Internals

LLM NameQwen3 4B DFlash B16
Repository πŸ€—https://huggingface.co/z-lab/Qwen3-4B-DFlash-b16 
Model Size4b
Required VRAM1.1 GB
Updated2026-07-21
Maintainerz-lab
Model Typeqwen3
Model Files  1.1 GB
Model ArchitectureDFlashDraftModel
Licensemit
Context Length40960
Model Max Length40960
Transformers Version4.57.3
Vocabulary Size151936

Best Alternatives to Qwen3 4B DFlash B16

Best Alternatives
Context / RAM
Downloads
Likes
Qwen3.5 4B DFlash256K / 1.3 GB1852633
Note: green Score (e.g. "73.2") means that the model is better than z-lab/Qwen3-4B-DFlash-b16.