LLM EXPLORER 62,076 MODELS INDEXED

Instella MoE 16B A3B SFT W4a16 Llmcompressor by amd

By amd · 110 downloads

Instella MoE 16B A3B SFT W4a16 Llmcompressor is an open-source language model by amd. Features: 15.1b LLM, VRAM: 30.4GB, Context: 32K, License: other, MoE, LLM Explorer Score: 0.31.

  4-bit   Amd Base model:amd/instella-moe-16... Base model:quantized:amd/inste...   Compressed-tensors   Conversational   Cpu-inference   Custom code   Deepseek v3   En   Endpoints compatible   Int4   Llm-compressor   Moe   Quantized   Region:us   Safetensors   Sharded   Tensorflow   W4a16   Weight-only   Zendnn

Instella MoE 16B A3B SFT W4a16 Llmcompressor Parameters and Internals

LLM NameInstella MoE 16B A3B SFT W4a16 Llmcompressor
Repository 🤗https://huggingface.co/amd/Instella-MoE-16B-A3B-SFT-w4a16-llmcompressor 
Base Model(s)  Instella MoE 16B A3B SFT   amd/Instella-MoE-16B-A3B-SFT
Model Size15.1b
Required VRAM30.4 GB
Updated2026-09-24
Maintaineramd
Model Typedeepseek_v3
Model Files  20.0 GB: 1-of-2   10.4 GB: 2-of-2
Supported Languagesen
Model ArchitectureInstellaMoEForCausalLM
Licenseother
Context Length32768
Model Max Length32768
Transformers Version5.14.1
Tokenizer ClassTokenizersBackend
Padding Token<|end▁of▁sentence|>
Vocabulary Size128896