HF RL Explorer

dusersad12/verl-deepscaler-clean

verl-deepscaler-clean: RL dataset on Hugging Face. A cleaned, deduplicated release of the DeepScaleR math problem set, packaged in the parquet layout that verl expects from its RLHFDataset, so it can be dropped straight into a GRPO / rule-based-reward run (for example, when re-running an R1-style…

dusersad12/verl-deepscaler-clean on the Hugging Face Hub