Skip to yearly menu bar Skip to main content


Poster Tue, Oct 6, 2026 • 11:00 AM – 1:00 PM PDT Grand Ballroom #109

HeaPA: Difficulty-Aware Heap Sampling and On-Policy Query Augmentation for LLM Reinforcement Learning

Weiqi Wang ⋅ Xin Liu ⋅ Binxuan Huang ⋅ Hejie Cui ⋅ Rongzhi Zhang ⋅ Changlong Yu ⋅ Shuowei Jin ⋅ Jingfeng Yang ⋅ Qingyu Yin ⋅ Zhengyang Wang ⋅ Zheng Li ⋅ Yifan Gao ⋅ Priyanka Nigam ⋅ Bing Yin ⋅ Lihong Li ⋅ Yangqiu Song

Abstract

Log in and register to view live content