LLM EXPLORER 59,694 MODELS INDEXED

DeepSeek R1 0528 Qwen3 8B Esper3 by ValiantLabs

By ValiantLabs · 15 downloads

DeepSeek R1 0528 Qwen3 8B Esper3 is an open-source language model by ValiantLabs. Features: 8b LLM, VRAM: 32.7GB, Context: 128K, License: apache-2.0, Instruction-Based, LLM Explorer Score: 0.18.

  8b   Analytical   Architect   Aws   Azure Base model:deepseek-ai/deepsee... Base model:finetune:deepseek-a...   Chat   Cloud   Code   Code-instruct   Conversational   Creative Dataset:sequelbox/raiden-deeps... Dataset:sequelbox/tachibana2-d... Dataset:sequelbox/titanium2.1-...   Deepseek   Deepseek-r1   Deepseek-r1-0528   Dev-ops   Developer   En   Endpoints compatible   Engineer   Esper   Esper-3   Expert   Gcp   Instruct   Javascript   Jenkins   Powershell   Problem-solving   Python   Qwen   Qwen-3   Qwen-3-8b   Qwen3   Rationality   Reasoning   Region:us   Safetensors   Scripting   Sharded   Tensorflow   Terraform   Valiant   Valiant-labs

DeepSeek R1 0528 Qwen3 8B Esper3 Parameters and Internals

LLM NameDeepSeek R1 0528 Qwen3 8B Esper3
Repository 🤗https://huggingface.co/ValiantLabs/DeepSeek-R1-0528-Qwen3-8B-Esper3 
Base Model(s)  DeepSeek R1 0528 Qwen3 8B   deepseek-ai/DeepSeek-R1-0528-Qwen3-8B
Model Size8b
Required VRAM32.7 GB
Updated2026-08-03
MaintainerValiantLabs
Model Typeqwen3
Instruction-BasedYes
Model Files  5.0 GB: 1-of-7   4.8 GB: 2-of-7   4.8 GB: 3-of-7   5.0 GB: 4-of-7   4.8 GB: 5-of-7   4.8 GB: 6-of-7   3.5 GB: 7-of-7
Supported Languagesen
Model ArchitectureQwen3ForCausalLM
Licenseapache-2.0
Context Length131072
Model Max Length131072
Transformers Version4.52.3
Tokenizer ClassLlamaTokenizerFast
Beginning of Sentence Token<|begin▁of▁sentence|>
End of Sentence Token<|end▁of▁sentence|>
Vocabulary Size151936
Torch Data Typefloat32

Best Alternatives to DeepSeek R1 0528 Qwen3 8B Esper3

Best Alternatives
Context / RAM
Downloads
Likes
DeepAnalyze 8B128K / 16.4 GB51293
WebWorld 8B40K / 16.4 GB95064
WebWorld 32B40K / 65.8 GB34275
...nBias Plus SFT Instruct Legacy40K / 16.4 GB3831
WebWorld 14B40K / 29.5 GB50428
...n3 8B UnBias Plus SFT Instruct40K / 16.4 GB541
QVikhr 3 8B Instruction40K / 16.4 GB384610
ATLAS 8B Instruct40K / 16.4 GB212
Qwen3 8B ShiningValiant340K / 32.7 GB113
Qwen3 8B Shadow FT BAAI 2K40K / 16.4 GB90
Note: green Score (e.g. "73.2") means that the model is better than ValiantLabs/DeepSeek-R1-0528-Qwen3-8B-Esper3.