SmolLM2 360M Instruct Q8 Mlx is an open-source language model by HuggingFaceTB. Features: 360m LLM, VRAM: 0.4GB, Context: 8K, License: apache-2.0, Quantized, Instruction-Based.
| LLM Name | SmolLM2 360M Instruct Q8 Mlx |
| Repository π€ | https://huggingface.co/HuggingFaceTB/SmolLM2-360M-Instruct-Q8-mlx |
| Base Model(s) | |
| Model Size | 360m |
| Required VRAM | 0.4 GB |
| Updated | 2026-08-09 |
| Maintainer | HuggingFaceTB |
| Model Type | llama |
| Instruction-Based | Yes |
| Model Files | |
| Supported Languages | en |
| Quantization Type | q8 |
| Model Architecture | LlamaForCausalLM |
| License | apache-2.0 |
| Context Length | 8192 |
| Model Max Length | 8192 |
| Transformers Version | 4.42.3 |
| Tokenizer Class | GPT2Tokenizer |
| Padding Token | <|im_end|> |
| Vocabulary Size | 49152 |
| Torch Data Type | bfloat16 |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| SmolLM2 360M Instruct Bnb 4bit | 8K / 0.3 GB | 520 | 3 |
| SmolLM2 360M Bnb 4bit | 8K / 0.3 GB | 46 | 2 |
| SmolLM 360M Instruct 8bit | 2K / 0.4 GB | 46 | 2 |
| Smol Lm2 360 Instruct | 8K / 0.7 GB | 307 | 3 |
| SmolLM2 360M Instruct | 8K / 0.7 GB | 476032 | 208 |
| Smollm2 360M Text2sql Sft | 8K / 1.4 GB | 194 | 0 |
| Smollm3 720prms | 8K / 0.7 GB | 5 | 0 |
| ProseFlow V1 360M Instruct | 8K / 0.7 GB | 5 | 1 |
| SmolLM2 Rethink 360M | 8K / 1.4 GB | 13 | 1 |
| SolaraV2 Coder 0511 | 8K / 0.7 GB | 13 | 1 |