LLM EXPLORER 62,696 MODELS INDEXED

Swift 1.5 Qwen3.8 Flash Next W4A16 FP8PLE by auggie246

By auggie246 · 64 downloads

Swift 1.5 Qwen3.8 Flash Next W4A16 FP8PLE is an open-source language model by auggie246. Features: 70.4b LLM, VRAM: 51.9GB, License: other, LLM Explorer Score: 0.31.

  256k-context   4-bit   Auto-round   Autoround Base model:quantized:qwen/qwen... Base model:qwen/qwen3.8-flash-...   Conversational   Endpoints compatible   Fp8   Image-text-to-text   Int4   Qwen3.8   Qwen4 exp   Region:us   Safetensors   Sharded   Speculative-decoding   Swift   Tensorflow   Vllm

Swift 1.5 Qwen3.8 Flash Next W4A16 FP8PLE Parameters and Internals

LLM NameSwift 1.5 Qwen3.8 Flash Next W4A16 FP8PLE
Repository πŸ€—https://huggingface.co/auggie246/Swift-1.5-Qwen3.8-Flash-Next-W4A16-FP8PLE 
Base Model(s)  ukisai/Swift-1.5-Qwen3.8-Flash-Next-W4A16-AutoRound   RadixArk/Qwen3.8-Flash-Next-NVFP4   Qwen/Qwen3.8-Flash-Next   ukisai/Swift-1.5-Qwen3.8-Flash-Next-W4A16-AutoRound   RadixArk/Qwen3.8-Flash-Next-NVFP4   Qwen/Qwen3.8-Flash-Next
Model Size70.4b
Required VRAM51.9 GB
Updated2026-10-01
Maintainerauggie246
Model Typeqwen4_exp
Model Files  1.4 GB: 1-of-81   1.4 GB: 2-of-81   0.1 GB: 34-of-81   1.4 GB: 35-of-81   1.4 GB: 36-of-81   1.4 GB: 37-of-81   1.4 GB: 38-of-81   1.4 GB: 39-of-81   1.4 GB: 40-of-81   1.4 GB: 41-of-81   1.4 GB: 42-of-81   1.4 GB: 43-of-81   1.4 GB: 44-of-81   1.4 GB: 45-of-81   1.4 GB: 46-of-81   1.4 GB: 47-of-81   1.4 GB: 48-of-81   1.4 GB: 49-of-81   1.4 GB: 50-of-81   1.4 GB: 51-of-81   1.4 GB: 52-of-81   1.4 GB: 53-of-81   1.4 GB: 54-of-81   1.4 GB: 55-of-81   1.4 GB: 56-of-81   1.4 GB: 57-of-81   1.4 GB: 58-of-81   1.4 GB: 59-of-81   1.4 GB: 60-of-81   1.4 GB: 61-of-81   1.4 GB: 62-of-81   1.4 GB: 63-of-81   1.4 GB: 64-of-81   1.4 GB: 65-of-81   1.4 GB: 66-of-81   1.4 GB: 67-of-81   1.4 GB: 68-of-81   1.4 GB: 69-of-81
Model ArchitectureQwen4ExpForConditionalGeneration
Licenseother
Transformers Version5.16.1