human+artificial intelligence lab.
/
Lab seminar
/
Sequential Preference Ranking for Efficient Reinforcement Learning from Human Feedback
Search
Share
Sequential Preference Ranking for Efficient Reinforcement Learning from Human Feedback
μν
Done
λ μ§/date
2025/02/21
λ°νμ/presenter
Donggyu Lee
λ°νμλ£/file
μ΄λκ·_λ°νμλ£_250221_022920 (1).pdf