arxiv:2602.16165
Jon Peng
jonp07
AI & ML interests
None yet
Recent Activity
published a model about 21 hours ago
jonp07/alfworld-rollouts authored a paper 5 months ago
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents updated a model 5 months ago
jonp07/GRPO-ALFWorld