sungyub/docqa-rl-verl
docqa-rl-verl: DocQA-RL-1.6K (VERL Format): RL dataset on Hugging Face. This dataset contains 1,591 challenging long-context document QA problems from DocQA-RL-1.6K, converted to VERL (Volcano Engine Reinforcement Learning) format for reinforcement learning training workflows. Source…