SWE-Prime: Fewer Trajectories, Better Performance
By Dewu Zheng · Paper · cs.SE
To improve large language models' ability to resolve real-world software issues, prior work has focused on constructing large-scale agent trajectory datasets and performing supervised fine-tuning (SFT) on successful trajectories. However, task success does not guarantee high-qual