Oct 18, 2024
Improving Reward Models with Synthetic Critiques
Authors
Zihuiwen Ye, Fraser Greenlee-Scott, Max Bartolo, Phil Blunsom, Jon Ander Campos, Matthias Gallé
Abstract
Related works

Research
BERT-as-a-Judge: A Robust Alternative to Lexical Methods for Efficient Reference-Based LLM Evaluation
Read

Research
BidirLM: From Text to Omnimodal Bidirectional Encoders by Adapting and Composing Causal LLMs
Read

Research
The IOL-AI Challenge: An Open Challenge towards Advancing Linguistic Reasoning
Read






