AI & ML interests
RL, Agent, Efficient ML
Organizations
upvoted a paper 5 months ago upvoted a paper 7 months ago view article Navigating the RLHF Landscape: From Policy Gradients to PPO, GAE, and DPO for LLM Alignment
NormalUhr
• • 133
upvoted a paper 11 months ago upvoted a paper 12 months ago upvoted a paper about 1 year ago upvoted a paper over 1 year ago