Karthik Iyer
kiyer97
AI & ML interests
Reinforcement learning, reward modeling, RLHF, policy optimization, offline RL
Recent Activity
liked a dataset 18 minutes ago
youinwww/reinforcement_learning upvoted a paper 18 minutes ago
Towards Full Pipeline FP8 Reinforcement Learning for LLMs upvoted a paper 18 minutes ago
ShieldVLA: Feasibility-Aware Safety Alignment for Vision-Language-Action ModelsOrganizations
None yet