HF RL Explorer

nvidia/Nemotron-RL-Instruction-Following-MultiTurnChat-v1

Nemotron-RL-Instruction-Following-MultiTurnChat-v1: NeMo Gym dataset on Hugging Face. The MultiChallenge Dataset is a rigorous benchmark designed to improve large language models in complex multi-turn conversations by explicitly targeting inference memory, instruction retention, version editing…

nvidia/Nemotron-RL-Instruction-Following-MultiTurnChat-v1 on the Hugging Face Hub