LLM EXPLORER 59,962 MODELS INDEXED

Qwen3.8 Flash Next 0.2B A0.2B by inference-optimization

By inference-optimization · 323 downloads

Qwen3.8 Flash Next 0.2B A0.2B is an open-source language model by inference-optimization. Features: 0.2b LLM, VRAM: 0.3GB, License: mit, LLM Explorer Score: 0.32.

Base model:finetune:qwen/qwen3... Base model:qwen/qwen3.8-flash-...   Conversational   Endpoints compatible   Image-text-to-text   Qwen4 exp   Region:us   Safetensors

Qwen3.8 Flash Next 0.2B A0.2B Parameters and Internals

LLM NameQwen3.8 Flash Next 0.2B A0.2B
Repository πŸ€—https://huggingface.co/inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B 
Base Model(s)  Qwen/Qwen3.8-Flash-Next   Qwen/Qwen3.8-Flash-Next
Model Size0.2b
Required VRAM0.3 GB
Updated2026-08-30
Maintainerinference-optimization
Model Typeqwen4_exp
Model Files  0.3 GB
Model ArchitectureQwen4ExpForConditionalGeneration
Licensemit
Model Max Length262144
Transformers Version5.16.1
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace