HARM: Learning Hate-Aware Reward Model for Evaluating Natural Language Explanations of Offensive Content
- Lorenzo Puppi Vecchi
- , Alceu de Souza Britto
- , Emerson Cabrera Paraiso
- , Rafael Menelau Cruz
- Pontifícia Universidade Católica do Paraná
Research output: Contribution to Book/Report types › Contribution to conference proceedings › peer-review