Computation and Language · Computer Science
Discourse-Aware Neural Rewards for Coherent Text Generation
Antoine Bosselut, Asli Celikyilmaz, Xiaodong He, Jianfeng Gao +2
2018-05-11
Computation and Language · Computer Science
A Constraint-Enforcing Reward for Adversarial Attacks on Text Classifiers
Tom Roth, Inigo Jauregi Unanue, Alsharif Abuadbba, Massimo Piccardi
2024-05-21
Computation and Language · Computer Science
Neural Headline Generation with Sentence-wise Optimization
Ayana, Shiqi Shen, Yu Zhao, Zhiyuan Liu +1
2016-10-11
Computation and Language · Computer Science
Neural Keyphrase Generation via Reinforcement Learning with Adaptive Rewards
Hou Pong Chan, Wang Chen, Lu Wang, Irwin King
2019-06-11
Computation and Language · Computer Science
Toward Diverse Text Generation with Inverse Reinforcement Learning
Zhan Shi, Xinchi Chen, Xipeng Qiu, Xuanjing Huang
2018-06-08
Computation and Language · Computer Science
Beyond Sparse Rewards: Enhancing Reinforcement Learning with Language Model Critique in Text Generation
Meng Cao, Lei Shu, Lei Yu, Yun Zhu +3
2024-02-20
Machine Learning · Computer Science
Adversarial Training of Reward Models
Alexander Bukharin, Haifeng Qian, Shengyang Sun, Adithya Renduchintala +5
2025-04-15
Computation and Language · Computer Science
Reward Gaming in Conditional Text Generation
Richard Yuanzhe Pang, Vishakh Padmakumar, Thibault Sellam, Ankur P. Parikh +1
2023-06-02
Machine Learning · Computer Science
Break it, Imitate it, Fix it: Robustness by Generating Human-Like Attacks
Aradhana Sinha, Ananth Balashankar, Ahmad Beirami, Thi Avrahami +2
2024-02-16
Computation and Language · Computer Science
ARAML: A Stable Adversarial Training Framework for Text Generation
Pei Ke, Fei Huang, Minlie Huang, Xiaoyan Zhu
2019-08-21
Computation and Language · Computer Science
reWordBench: Benchmarking and Improving the Robustness of Reward Models with Transformed Inputs
Zhaofeng Wu, Michihiro Yasunaga, Andrew Cohen, Yoon Kim +2
2025-09-22
Computation and Language · Computer Science
Learning Goal-Conditioned Representations for Language Reward Models
Vaskar Nath, Dylan Slack, Jeff Da, Yuntao Ma +3
2024-10-25
Computation and Language · Computer Science
Adversarial Learning for Neural Dialogue Generation
Jiwei Li, Will Monroe, Tianlin Shi, Sébastien Jean +2
2017-09-26