{"id":"e638bd48-a3be-49de-bbae-29535fbc46d4","slug":"hf-model-amd-hylo-llama-4mla12gdn-8k-sft-12srojt-v","name":"HyLo-Llama-4MLA12GDN-8K-SFT","description":"Hugging Face model amd/HyLo-Llama-4MLA12GDN-8K-SFT. Task: text generation. 47 downloads.","capabilities":["safetensors","llama","hybrid","mla","gated-deltanet","long-context","kv-cache-compression","distillation","amd","text-generation","conversational","en","dataset:JunxiongWang/sftdatasetv3","dataset:nvidia/OpenMathInstruct-2","dataset:open-thoughts/OpenThoughts-114k","dataset:open-r1/OpenR1-Math-220k","dataset:nvidia/ChatQA2-Long-SFT-data","arxiv:2604.24715","arxiv:2505.17272","arxiv:2503.11132"],"protocols":[],"safetyScore":80,"overallRank":35,"trustScore":null,"trust":null,"source":"HUGGINGFACE","updatedAt":"2026-10-11T20:38:12.787Z"}