CodeMidas: Scaling Agentic Coding RL Environments from Code Itself Paper • 2609.22068 • Published 16 days ago • 138
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published about 1 month ago • 248
Beyond the Stability-Exploration Dilemma: Environmental Regularization for LLM Policy Optimization Paper • 2608.23311 • Published Aug 24 • 17
JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion Paper • 2608.03974 • Published Aug 4 • 107
JoyAI-VL-Interaction: Real-Time Vision-Language Interaction Intelligence Paper • 2606.14777 • Published Jun 10 • 219
Crafter: A Multi-Agent Harness for Editable Scientific Figure Generation from Diverse Inputs Paper • 2605.30611 • Published May 28 • 65
Spreadsheet-RL: Advancing Large Language Model Agents on Realistic Spreadsheet Tasks via Reinforcement Learning Paper • 2605.22642 • Published May 21 • 36
InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents Paper • 2403.02691 • Published Mar 5, 2024 • 2
Hidden States as Early Signals: Step-level Trace Evaluation and Pruning for Efficient Test-Time Scaling Paper • 2601.09093 • Published Jan 14 • 2
Hidden States as Early Signals: Step-level Trace Evaluation and Pruning for Efficient Test-Time Scaling Paper • 2601.09093 • Published Jan 14 • 2
view article Article KV Caching Explained: Optimizing Transformer Inference Efficiency not-lain • Jan 30, 2025 • 424
InFoBench: Evaluating Instruction Following Ability in Large Language Models Paper • 2401.03601 • Published Jan 7, 2024 • 6