Don't Mask the Environment: Observation Supervision Changes How Agents Explore Under RL Paper • 2609.20715 • Published 11 days ago • 44
VākQA: A Benchmark and Evaluation Study for Telugu Spoken Factoid Question Answering Paper • 2609.19879 • Published 11 days ago • 33
Memory as Plans: World-Action Modeling with Memory-Grounded Planning Paper • 2609.11561 • Published 18 days ago • 41
Scaling Automatic Research Agents via World Models Paper • 2608.12564 • Published about 1 month ago • 480
deepseek-ai/DeepSeek-V4-Flash-Vision-Exp Image-Text-to-Text • 305B • Updated 27 days ago • 941k • • 928
VidaForge: Open Research Infrastructure for Video Pretraining Data Recipes Paper • 2609.06652 • Published 22 days ago • 20
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 25 days ago • 245
Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training Paper • 2608.26730 • Published Aug 27 • 155