HF RL Explorer

sungyub/guru-table-verl

guru-table-verl: RL dataset on Hugging Face. This dataset contains 8,230 table reasoning samples from 3 datasets (HiTab, MultiHierTT, FinQA) for reinforcement learning training with VERL (Volcano Engine Reinforcement Learning). The data is extracted and preprocessed from LLM360/guru-RL-92k.

sungyub/guru-table-verl on the Hugging Face Hub