LLM EXPLORER 58,608 MODELS INDEXED

Qwen3.8 27B MTPLX Optimized Speed FP16 by Youssofal

By Youssofal · 1577 downloads

Qwen3.8 27B MTPLX Optimized Speed FP16 is an open-source language model by Youssofal. Features: 27b LLM, VRAM: 19.6GB, License: apache-2.0, Quantized.

  4-bit   Apple-silicon Base model:quantized:qwen/qwen...   Base model:qwen/qwen3.8-27b   Coding   Conversational   Fp16   Local-ai   M1   M2   Macos   Mlx   Mtp   Mtplx   Multi-token-prediction   Quantized   Qwen   Qwen3.8   Qwen3 5   Region:us   Safetensors   Sharded   Speculative-decoding   Tensorflow

Qwen3.8 27B MTPLX Optimized Speed FP16 Parameters and Internals

LLM NameQwen3.8 27B MTPLX Optimized Speed FP16
Repository πŸ€—https://huggingface.co/Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16 
Base Model(s)  Qwen/Qwen3.8-27B   Qwen/Qwen3.8-27B
Model Size27b
Required VRAM19.6 GB
Updated2026-08-17
MaintainerYoussofal
Model Typeqwen3_5
Model Files  5.4 GB: 1-of-4   5.3 GB: 2-of-4   5.4 GB: 3-of-4   3.5 GB: 4-of-4   0.9 GB   0.8 GB
Quantization Typefp16
Model ArchitectureQwen3_5ForConditionalGeneration
Licenseapache-2.0
Model Max Length262144
Transformers Version5.8.0.dev0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace

Best Alternatives to Qwen3.8 27B MTPLX Optimized Speed FP16

Best Alternatives
Context / RAM
Downloads
Likes
Qwen3.6 27B OptiQ 4bit256K / 18.7 GB1306559
Bonsai 27B Mlx 1bit0K / 5.1 GB809309205
Qwen3.8 27B 8bit0K / 29.4 GB1389233
Ternary Bonsai 27B Mlx 2bit0K / 8.5 GB809024168
Qwen3.8 27B 4bit0K / 16 GB605527
Qwen3.8 27B MLX 4bit0K / 16 GB1971210
Qwen3.8 27B MLX 8bit0K / 29.4 GB248117
Qwen3.6 27B MLX 8bit0K / 29.4 GB87914514
Qwen3.6 27B MLX 6bit0K / 22.7 GB8129772
...X Qwen3.8 27B MLX AXQ 6bit MTP0K / 19 GB26515
Note: green Score (e.g. "73.2") means that the model is better than Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16.