Arjun Patel
apatel-1995
ยท
AI & ML interests
Reinforcement learning, reward modeling, RLHF, policy optimization, offline RL
Recent Activity
liked a dataset 1 day ago
andersonbcdefg/red_teaming_reward_modeling_pairwise liked a dataset 1 day ago
ProlificAI/social-reasoning-rlhf upvoted a paper 1 day ago
Language Models Are "Insecure" ReportersOrganizations
None yet