LLM EXPLORER 58,425 MODELS INDEXED

Qwen3.8 1.0B A0.6B by inference-optimization

By inference-optimization · 1805 downloads

Qwen3.8 1.0B A0.6B is an open-source language model by inference-optimization. Features: 966.1m LLM, VRAM: 1.9GB, Context: 256K, License: mit, MoE, LLM Explorer Score: 0.35.

Base model:finetune:qwen/qwen3... Base model:qwen/qwen3.8-2.4t-a...   Conversational   Endpoints compatible   Moe   Qwen3 5 moe text   Region:us   Safetensors

Qwen3.8 1.0B A0.6B Parameters and Internals

LLM NameQwen3.8 1.0B A0.6B
Repository πŸ€—https://huggingface.co/inference-optimization/Qwen3.8-1.0B-A0.6B 
Base Model(s)  Qwen/Qwen3.8-2.4T-A95B   Qwen/Qwen3.8-2.4T-A95B
Model Size966.1m
Required VRAM1.9 GB
Updated2026-08-14
Maintainerinference-optimization
Model Typeqwen3_5_moe_text
Model Files  1.9 GB   0.0 GB
Model ArchitectureQwen3_5MoeForCausalLM
Licensemit
Context Length262144
Model Max Length262144
Transformers Version5.16.0.dev0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Vocabulary Size248320
Errorsreplace