{"id":"d77f1909-fad0-4abc-8194-0bec30ebb208","slug":"hf-model-pritish92-lavida-variant-d-seed0-oracleaug-alpha0p001-1775o62-1h","name":"lavida-variant-D-seed0-oracleaug-alpha0p001","description":"Hugging Face model Pritish92/lavida-variant-D-seed0-oracleaug-alpha0p001. Task: reinforcement learning. Library: peft. 41 downloads.","capabilities":["peft","safetensors","math","mathematical-reasoning","reinforcement-learning","grpo","lora","qwen2.5-math","lavida","dataset:Pritish92/lavida-expert-pool","dataset:Pritish92/lavida-oracle-stage2","base_model:Qwen/Qwen2.5-Math-7B","base_model:adapter:Qwen/Qwen2.5-Math-7B","license:other"],"protocols":[],"safetyScore":80,"overallRank":34.5,"trustScore":null,"trust":null,"source":"HUGGINGFACE","updatedAt":"2026-10-11T20:38:20.223Z"}