Gemma 4 31B It Qat Assistant Mxfp8 is an open-source language model by mlx-community. Features: 31b LLM, VRAM: 0.5GB, License: gemma, Quantized, LLM Explorer Score: 0.26.
| LLM Name | Gemma 4 31B It Qat Assistant Mxfp8 |
| Repository π€ | https://huggingface.co/mlx-community/gemma-4-31B-it-qat-assistant-mxfp8 |
| Base Model(s) | |
| Model Size | 31b |
| Required VRAM | 0.5 GB |
| Updated | 2026-08-10 |
| Maintainer | mlx-community |
| Model Type | gemma4_assistant |
| Model Files | |
| Supported Languages | en |
| Quantization Type | q4|q4_0 |
| Model Architecture | Gemma4AssistantForCausalLM |
| License | gemma |
| Transformers Version | 5.10.0.dev0 |
| Tokenizer Class | GemmaTokenizer |
| Padding Token | <pad> |
Best Alternatives |
Context / RAM |
Downloads |
Likes |
|---|---|---|---|
| ...Qat Q4 0 Unquantized Assistant | 0K / 0.9 GB | 25778 | 22 |
| ...ma 4 31B It Qat Assistant Bf16 | 0K / 0.9 GB | 495 | 1 |
| Gemma 4 31B It Assistant | 0K / 0.9 GB | 1539849 | 315 |
| Gemma 4 31B It Assistant Bf16 | 0K / 0.9 GB | 2975 | 14 |
| Gemma 4 31B It Assistant Fp8 | 0K / 0.8 GB | 199 | 2 |