Nov 28, 2021
Mitigating Harm in Language Models with Conditional-Likelihood Filtration
Authors
Helen Ngo, Cooper Raterink, João G.M. Araújo, Ivan Zhang, Carol Chen, Adrien Morisot, Nicholas Frosst
Abstract
Related works
AI for Empowerment: Your freedom. Your focus. See how AI gives you more time for what truly moves you.
Explore nowNov 28, 2021
Authors
Helen Ngo, Cooper Raterink, João G.M. Araújo, Ivan Zhang, Carol Chen, Adrien Morisot, Nicholas Frosst
Abstract
Related works