HARM: Learning Hate-Aware Reward Model for Evaluating Natural Language Explanations of Offensive Content
- Lorenzo Puppi Vecchi
- , Alceu de Souza Britto
- , Emerson Cabrera Paraiso
- , Rafael Menelau Cruz
- Pontifícia Universidade Católica do Paraná
Résultats de recherche: Chapitre dans un livre, rapport, actes de conférence › Participation à un ouvrage collectif lié à un colloque ou une conférence › Revue par des pairs