-
Behavior Knowledge Merge in Reinforced Agentic Models
Paper • 2601.13572 • Published • 27 -
Language of Thought Shapes Output Diversity in Large Language Models
Paper • 2601.11227 • Published • 10 -
Agentic-R: Learning to Retrieve for Agentic Search
Paper • 2601.11888 • Published • 19 -
RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
Paper • 2602.02488 • Published • 36
FE
FE20252
·
AI & ML interests
None yet
Organizations
None yet
Agent-finetuning-RAM-METHOD
-
Behavior Knowledge Merge in Reinforced Agentic Models
Paper • 2601.13572 • Published • 27 -
Language of Thought Shapes Output Diversity in Large Language Models
Paper • 2601.11227 • Published • 10 -
Agentic-R: Learning to Retrieve for Agentic Search
Paper • 2601.11888 • Published • 19 -
RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
Paper • 2602.02488 • Published • 36
models 0
None public yet
datasets 0
None public yet