LLM EXPLORER 58,608 MODELS INDEXED

Qwen3 4B Thinking 2507 Qwen3.8 Max Distillation Detrax by detrax

By detrax · 1366 downloads

Qwen3 4B Thinking 2507 Qwen3.8 Max Distillation Detrax is an open-source language model by detrax. Features: 4b LLM, VRAM: 2.5GB, Context: 256K, License: apache-2.0, Quantized.

Base model:quantized:qwen/qwen... Base model:qwen/qwen3-4b-think...   Code-generation   Conversational Dataset:r0b0tlab/qwen3.8-max-d...   Distilled   En   Endpoints compatible   Gguf   Llama.cpp   Mathematics   Q4   Quantized   Qwen3   Reasoning   Region:us

Qwen3 4B Thinking 2507 Qwen3.8 Max Distillation Detrax Parameters and Internals

LLM NameQwen3 4B Thinking 2507 Qwen3.8 Max Distillation Detrax
Repository πŸ€—https://huggingface.co/detrax/Qwen3-4B-Thinking-2507-Qwen3.8-Max-Distillation-Detrax 
Base Model(s)  Qwen3 4B Thinking 2507   Qwen/Qwen3-4B-Thinking-2507
Model Size4b
Required VRAM2.5 GB
Updated2026-08-17
Maintainerdetrax
Model Typeqwen3
Model Files  2.5 GB   3.3 GB   4.3 GB
Supported Languagesen
GGUF QuantizationYes
Quantization Typegguf|q4|q4_k
Model ArchitectureQwen3ForCausalLM
Licenseapache-2.0
Context Length262144
Model Max Length262144
Transformers Version5.5.0
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Vocabulary Size151936
Errorsreplace

Best Alternatives to Qwen3 4B Thinking 2507 Qwen3.8 Max Distillation Detrax

Best Alternatives
Context / RAM
Downloads
Likes
Qwen3.8 4B Distilled GGUF256K / 2.5 GB3408516
...wen3 4B Toolcalling Gguf Codex256K / 4.3 GB261355
...B Toolcall Gguf Llamacpp Codex256K / 4.3 GB13049
...wen3 4B Thinking 2507 Hermes 3256K / 8.1 GB1572
Qwen3 4B Tcomanr Merge V2.2256K / 8 GB282
Qwen3 4B Tcomanr Merge V2256K / 8 GB52
Qwen3 4B 128K GGUF128K / 1.1 GB133027
Qwen3 4B GGUF40K / 1.1 GB131929229
MiniAI Quata1 4B40K / 8.1 GB270
Hmanlab Ai V0.140K / 8.1 GB951
Note: green Score (e.g. "73.2") means that the model is better than detrax/Qwen3-4B-Thinking-2507-Qwen3.8-Max-Distillation-Detrax.