HF RL Explorer

pre-to-post-olmo/rl-math-skyeasy25k-omi2

rl-math-skyeasy25k-omi2: rl-math (deepscaler-easy + OpenMathInstruct-2): RL dataset on Hugging Face. Easy-biased math RL dataset (verl format; prompts system, user with the OpenThoughts thinking system prompt; rule-based math verify reward).

pre-to-post-olmo/rl-math-skyeasy25k-omi2 on the Hugging Face Hub