LLM EXPLORER 59,962 MODELS INDEXED

Qwen3.8 Flash Next MLX OQ8 MTP by Vontra

By Vontra · 1311 downloads

Qwen3.8 Flash Next MLX OQ8 MTP is an open-source language model by Vontra. Features: 56.5b LLM, VRAM: 203.6GB, License: other, LLM Explorer Score: 0.34.

  8-bit   Apple-silicon Base model:quantized:qwen/qwen... Base model:qwen/qwen3.8-flash-...   Conversational   Image-text-to-text   Mixture-of-experts   Mlx   Mlx-vlm   Mtp   Omlx   Oq   Quantized   Qwen   Qwen3.8   Qwen4 exp   Region:us   Safetensors   Sharded   Speculative-decoding   Tensorflow   Vision   Vision-language

Qwen3.8 Flash Next MLX OQ8 MTP Parameters and Internals

LLM NameQwen3.8 Flash Next MLX OQ8 MTP
Repository πŸ€—https://huggingface.co/Vontra/Qwen3.8-Flash-Next-MLX-oQ8-MTP 
Base Model(s)  Qwen/Qwen3.8-Flash-Next   Qwen/Qwen3.8-Flash-Next
Model Size56.5b
Required VRAM203.6 GB
Updated2026-08-30
MaintainerVontra
Model Typeqwen4_exp
Model Files  5.2 GB: 1-of-37   5.4 GB: 2-of-37   5.4 GB: 3-of-37   5.4 GB: 4-of-37   5.4 GB: 5-of-37   5.4 GB: 6-of-37   5.4 GB: 7-of-37   5.4 GB: 8-of-37   5.4 GB: 9-of-37   5.4 GB: 10-of-37   5.0 GB: 11-of-37   5.1 GB: 12-of-37   5.7 GB: 13-of-37   5.7 GB: 14-of-37   5.7 GB: 15-of-37   5.7 GB: 16-of-37   5.7 GB: 17-of-37   5.7 GB: 18-of-37   5.7 GB: 19-of-37   5.7 GB: 20-of-37   5.7 GB: 21-of-37   5.7 GB: 22-of-37   5.7 GB: 23-of-37   5.7 GB: 24-of-37   5.7 GB: 25-of-37   5.7 GB: 26-of-37   5.7 GB: 27-of-37   5.7 GB: 28-of-37   5.7 GB: 29-of-37   5.7 GB: 30-of-37   5.7 GB: 31-of-37   5.7 GB: 32-of-37   5.7 GB: 33-of-37   5.7 GB: 34-of-37   5.7 GB: 35-of-37   5.7 GB: 36-of-37   2.9 GB: 37-of-37
Model ArchitectureQwen4ExpForConditionalGeneration
Licenseother
Model Max Length262144
Transformers Version5.8.0.dev0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace