← 返回论文检索
KDD 2026Research Track

Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?

Yun Qu 0002, Qi Wang 0005, Yixiu Mao, Vincent Tao Hu, Björn Ommer, Xiangyang Ji

PDF 由论文原始站点提供,PaperCompass 不保存论文文件。DOI 10.1145/3770854.3780263 ↗

摘要

该来源暂未提供摘要。