Instella MoE 16B A3B SFT W4a16 Llmcompressor is an open-source language model by amd. Features: 15.1b LLM, VRAM: 30.4GB, Context: 32K, License: other, MoE, LLM Explorer Score: 0.31.
| LLM Name | Instella MoE 16B A3B SFT W4a16 Llmcompressor |
| Repository 🤗 | https://huggingface.co/amd/Instella-MoE-16B-A3B-SFT-w4a16-llmcompressor |
| Base Model(s) | |
| Model Size | 15.1b |
| Required VRAM | 30.4 GB |
| Updated | 2026-09-24 |
| Maintainer | amd |
| Model Type | deepseek_v3 |
| Model Files | |
| Supported Languages | en |
| Model Architecture | InstellaMoEForCausalLM |
| License | other |
| Context Length | 32768 |
| Model Max Length | 32768 |
| Transformers Version | 5.14.1 |
| Tokenizer Class | TokenizersBackend |
| Padding Token | <|end▁of▁sentence|> |
| Vocabulary Size | 128896 |