Submitted by Patrick Jiang 58 Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses chroma 1.01k 2