Kishan Panaganti
kishanpb
AI & ML interests
LLM Reasoning via RL and anything RL
Recent Activity
liked a dataset 3 days ago
XiaomiMiMo/MiMo-V2.6-RL-oss upvoted a paper 22 days ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning Experience submitted a paper 22 days ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning ExperienceOrganizations
None yet