HF RL Explorer

sungyub/docqa-rl-verl

docqa-rl-verl: DocQA-RL-1.6K (VERL Format): RL dataset on Hugging Face. This dataset contains 1,591 challenging long-context document QA problems from DocQA-RL-1.6K, converted to VERL (Volcano Engine Reinforcement Learning) format for reinforcement learning training workflows. Source…

sungyub/docqa-rl-verl on the Hugging Face Hub