Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Viet Dac Lai, Chien Nguyen, Nghia Ngo, Thuat Nguyen-Tran, Franck Dernoncourt, Ryan A. Rossi, Thien Huu Nguyen · 2023

Viet Lai, Chien Nguyen, Nghia Ngo, Thuat Nguyen, Franck Dernoncourt, Ryan Rossi, Thien Nguyen. Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing: System Demonstrations. 2023.

Read the paper · More papers on PaperTik