Karthik Iyer
kiyer97
AI & ML interests
Reinforcement learning, reward modeling, RLHF, policy optimization, offline RL
Recent Activity
upvoted a paper about 15 hours ago
SenseNova-U1.5: Towards Native Unified Visual Intelligence upvoted a paper about 15 hours ago
ModularRSI: Modular and Generalizable Recursive Harness Self-Improvement liked a dataset 1 day ago
jojo0217/korean_rlhf_datasetOrganizations
None yet