May 21, 2025
Reverse Engineering Human Preferences with Reinforcement Learning
Authors
Lisa Alazraki, Tan Yi-Chern, Jon Ander Campos, Maximilian Mozes, Marek Rei, Max Bartolo
Abstract
Related works

Research
Reality Check: A New Evaluation Ecosystem Is Necessary to Understand AI's Real World Effects
Read

Research
Findings of the WMT25 Multilingual Instruction Shared Task: Persistent Hurdles in Reasoning, Generation, and Evaluation
Read

Research
The IOL-AI Challenge: An Open Challenge towards Advancing Linguistic Reasoning
Read






