LLM EXPLORER 59,420 MODELS INDEXED

AlphaMaze V0.1 1.5B GRPO Cp 600 by jan-hq

By jan-hq · 7 downloads

AlphaMaze V0.1 1.5B GRPO Cp 600 is an open-source language model by jan-hq. Features: 1.5b LLM, VRAM: 3.5GB, Context: 128K, License: apache-2.0, LLM Explorer Score: 0.17.

Base model:finetune:jan-hq/alp... Base model:jan-hq/alphamaze-v0...   Conversational   En   Endpoints compatible   Qwen2   Region:us   Safetensors   Trl   Unsloth

AlphaMaze V0.1 1.5B GRPO Cp 600 Parameters and Internals

LLM NameAlphaMaze V0.1 1.5B GRPO Cp 600
Repository πŸ€—https://huggingface.co/jan-hq/AlphaMaze-v0.1-1.5B-GRPO-cp-600 
Base Model(s)  jan-hq/AlphaMaze-v0.1-1.5B   jan-hq/AlphaMaze-v0.1-1.5B
Model Size1.5b
Required VRAM3.5 GB
Updated2026-07-24
Maintainerjan-hq
Model Typeqwen2
Model Files  3.5 GB
Supported Languagesen
Model ArchitectureQwen2ForCausalLM
Licenseapache-2.0
Context Length131072
Model Max Length131072
Transformers Version4.48.3
Tokenizer ClassLlamaTokenizer
Padding Token<|vision_pad|>
Vocabulary Size151936
Torch Data Typebfloat16

Best Alternatives to AlphaMaze V0.1 1.5B GRPO Cp 600

Best Alternatives
Context / RAM
Downloads
Likes
Qwen2.5 1.5B 1.3M Stretched1280K / 3.1 GB110
ReaderLM V2500K / 3.1 GB35356804
Reader Lm 1.5B250K / 3.1 GB385608
DeepSeek R1 Distill Qwen 1.5B128K / 3.5 GB6000511545
Ko R1 1.5B Preview128K / 7.1 GB89
Qwen2.5 1.5B128K / 3.1 GB863295203
VibeThinker 1.5B128K / 3.5 GB3417552
Merge Cord V1128K / 3.1 GB1551
...FT Tulu3 Decontaminated Masked128K / 3.1 GB1670
Qwen2 1.5B128K / 3.1 GB195380102
Note: green Score (e.g. "73.2") means that the model is better than jan-hq/AlphaMaze-v0.1-1.5B-GRPO-cp-600.