RLPrompt: Optimizing Discrete Text Prompts with Reinforcement Learning

Mingkai Deng, Jianyu Wang, Cheng-Ping Hsieh, Yihan Wang, Han Wen Guo, Tianmin Shu, Meng Song, Eric P. Xing, Zhiting Hu · 2022

Mingkai Deng, Jianyu Wang, Cheng-Ping Hsieh, Yihan Wang, Han Guo, Tianmin Shu, Meng Song, Eric Xing, Zhiting Hu. Proceedings of the 2022 Conference on Empirical Methods in Natural Language Processing. 2022.

Read the paper · More papers on PaperTik