RefineBench: Evaluating Refinement Capability of Language Models via Checklists
RefineBench: Evaluating Refinement Capability of Language Models via Checklists Can language models (LMs) self-refine their own responses? This question is increasingly relevant as a wide range of real-world user interactions involve refinement requests. Ho…

