nvidia/Nemotron-RL-Multichallenge-v1
Nemotron-RL-Multichallenge-v1: NeMo Gym dataset on Hugging Face. License: cc-by-4.0 Task Categories: reinforcement-learning, text-generation Tags: instruction-following, multi-turn, rlvr, nemo-gym Configs: advanced train split at data/advanced.jsonl; vanilla train split at data/vanilla.jsonl…
nvidia/Nemotron-RL-Multichallenge-v1 on the Hugging Face Hub