LLM EXPLORER 61,060 MODELS INDEXED

HyLo Llama 8MLA8GDN 64K SFT by amd

By amd · 50 downloads

HyLo Llama 8MLA8GDN 64K SFT is an open-source language model by amd. Features: 1b LLM, VRAM: 6.5GB, Context: 128K, License: apache-2.0, Instruction-Based.

  Arxiv:2503.11132   Arxiv:2505.17272   Arxiv:2604.24715   Amd Base model:finetune:meta-llama... Base model:meta-llama/llama-3....   Conversational Dataset:junxiongwang/sftdatase... Dataset:nvidia/chatqa2-long-sf... Dataset:nvidia/openmathinstruc... Dataset:open-r1/openr1-math-22... Dataset:open-thoughts/openthou...   Distillation   En   Gated-deltanet   Hybrid   Instruct   Kv-cache-compression   Llama   Long-context   Mla   Region:us   Safetensors

HyLo Llama 8MLA8GDN 64K SFT Parameters and Internals

LLM NameHyLo Llama 8MLA8GDN 64K SFT
Repository πŸ€—https://huggingface.co/amd/HyLo-Llama-8MLA8GDN-64K-SFT 
Base Model(s)  meta-llama/Llama-3.2-1B-Instruct   meta-llama/Llama-3.2-1B-Instruct
Model Size1b
Required VRAM6.5 GB
Updated2026-09-14
Maintaineramd
Model Typellama
Instruction-BasedYes
Model Files  6.5 GB
Supported Languagesen
Model ArchitectureLlamaForCausalLM
Licenseapache-2.0
Context Length131072
Model Max Length131072
Transformers Version4.52.4
Tokenizer ClassPreTrainedTokenizer
Padding Token<|eot_id|>
Vocabulary Size128256
Torch Data Typebfloat16

Best Alternatives to HyLo Llama 8MLA8GDN 64K SFT

Best Alternatives
Context / RAM
Downloads
Likes
Llama 3.2 1B Instruct128K / 2.5 GB212072100
Llama 3.2 1B Instruct128K / 2.5 GB101146341549
...1B Claude Opus Fable5 Thinking128K / 2.2 GB6165166
LlaMa3.2 1B Instruct128K / 4.9 GB140
Llama3.2 1B CoT128K / 2.5 GB6321
Llama 3.2 1B Instruct Bf16128K / 2.5 GB5105
Llama 3.2 1B Instruct128K / 2.5 GB200
...Claude Opus Fable5 V2 Thinking128K / 2.2 GB2884
Llama3.2 1B Manumit V1128K / 2.5 GB1320
Type O1 Mini Instruct128K / 2.5 GB2320
Note: green Score (e.g. "73.2") means that the model is better than amd/HyLo-Llama-8MLA8GDN-64K-SFT.