LLM EXPLORER 60,783 MODELS INDEXED

Qwen3.5 122B A10B NVFP4 by nvidia

By nvidia · 248732 downloads

Qwen3.5 122B A10B NVFP4 is an open-source language model by nvidia. Features: 122b LLM, VRAM: 83.5GB, License: apache-2.0, LLM Explorer Score: 0.5, ELO: 1417.

  8-bit Base model:quantized:qwen/qwen... Base model:qwen/qwen3.5-122b-a...   Conversational   Deploy:azure   Fp4   Model optimizer   Modelopt   Nvfp4   Nvidia   Quantized   Qwen3.5   Qwen3 5 moe   Region:us   Safetensors   Sharded   Tensorflow

Qwen3.5 122B A10B NVFP4 Benchmarks

nn.n% — How the model compares to the reference models: Anthropic Sonnet 3.5 ("so35"), GPT-4o ("gpt4o") or GPT-4 ("gpt4").

Qwen3.5 122B A10B NVFP4 Parameters and Internals

LLM NameQwen3.5 122B A10B NVFP4
Repository πŸ€—https://huggingface.co/nvidia/Qwen3.5-122B-A10B-NVFP4 
Base Model(s)  Qwen/Qwen3.5-122B-A10B   Qwen/Qwen3.5-122B-A10B
Model Size122b
Required VRAM83.5 GB
Updated2026-08-05
Maintainernvidia
Model Typeqwen3_5_moe
Model Files  10.0 GB: 1-of-9   10.0 GB: 2-of-9   10.0 GB: 3-of-9   10.0 GB: 4-of-9   10.0 GB: 5-of-9   10.0 GB: 6-of-9   10.0 GB: 7-of-9   10.0 GB: 8-of-9   3.5 GB: 9-of-9
Model ArchitectureQwen3_5MoeForConditionalGeneration
Licenseapache-2.0
Model Max Length262144
Transformers Version5.6.2
Tokenizer ClassQwen2Tokenizer
Padding Token<|endoftext|>
Errorsreplace

Best Alternatives to Qwen3.5 122B A10B NVFP4

Best Alternatives
Context / RAM
Downloads
Likes
Qwen3.5 122B A10B0K / 248.6 GB2139628605
Qwen3.5 122B A10B0K / 248.6 GB451
Qwen3.5 122B A10B0K / 248.6 GB16808
Qwen3.5 122B A10B Abliterated0K / 248.6 GB595
Qwen3.5 122B A10B FP80K / 126.3 GB1271983112
Qwen3.5 122B A10B NVFP40K / 74 GB1826718
...en3.5 122B A10B Int4 AutoRound0K / 72 GB14231145
AREX Base0K / 164.2 GB57121
Qwen3.5 122B A10B WMix480K / 73.2 GB2153
Qwen3.5 122B A10B WMix580K / 87.5 GB2143