Get our free extension to see links to code for papers anywhere online!Free add-on: code for papers everywhere!Free add-on: See code for papers anywhere!

Add to Chrome

Add to Firefox

Add to Edge

Title:Self-Refinement of Language Models from External Proxy Metrics Feedback

Feb 27, 2024

Keshav Ramji, Young-Suk Lee, Ramón Fernandez Astudillo, Md Arafat Sultan, Tahira Naseem, Asim Munawar, Radu Florian, Salim Roukos

Figure 1 for Self-Refinement of Language Models from External Proxy Metrics Feedback

Figure 2 for Self-Refinement of Language Models from External Proxy Metrics Feedback

Figure 3 for Self-Refinement of Language Models from External Proxy Metrics Feedback

Figure 4 for Self-Refinement of Language Models from External Proxy Metrics Feedback

Share this with someone who'll enjoy it:

Abstract:It is often desirable for Large Language Models (LLMs) to capture multiple objectives when providing a response. In document-grounded response generation, for example, agent responses are expected to be relevant to a user's query while also being grounded in a given document. In this paper, we introduce Proxy Metric-based Self-Refinement (ProMiSe), which enables an LLM to refine its own initial response along key dimensions of quality guided by external metrics feedback, yielding an overall better final response. ProMiSe leverages feedback on response quality through principle-specific proxy metrics, and iteratively refines its response one principle at a time. We apply ProMiSe to open source language models Flan-T5-XXL and Llama-2-13B-Chat, to evaluate its performance on document-grounded question answering datasets, MultiDoc2Dial and QuAC, demonstrating that self-refinement improves response quality. We further show that fine-tuning Llama-2-13B-Chat on the synthetic dialogue data generated by ProMiSe yields significant performance improvements over the zero-shot baseline as well as a supervised fine-tuned model on human annotated data.

View paper on

Share this with someone who'll enjoy it:

Title:Self-Refinement of Language Models from External Proxy Metrics Feedback

Paper and Code