SWE-Prime: Fewer Trajectories, Better Performance

By Dewu Zheng · Paper · cs.SE

To improve large language models' ability to resolve real-world software issues, prior work has focused on constructing large-scale agent trajectory datasets and performing supervised fine-tuning (SFT) on successful trajectories. However, task success does not guarantee high-qual

Cs.se

View original

HomeResourceLoading…