Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents Paper • 2607.28227 • Published 4 days ago • 290
Grading the Narrators: An Isnad-Rijal Framework for Claim-Level Provenance in Multi-Agent Knowledge Systems Paper • 2607.24117 • Published 7 days ago • 3
StealthBench: Measuring Operational Stealth in Autonomous Offensive-Security Agents Paper • 2607.26314 • Published 6 days ago • 3
SecRespond: Benchmarking AI Agents for Real-World Post-Compromise Incident Response Paper • 2607.26791 • Published 5 days ago • 3
CADENCE: Closing the Reasoning Gap via Coverage-Adaptive On-Policy Distillation Paper • 2607.16955 • Published 16 days ago • 5
OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding Paper • 2607.27155 • Published 5 days ago • 10
Can AI agents conduct open-ended AI research? Early evidence from two case studies Paper • 2607.27191 • Published 5 days ago • 16
SpecFirst: Behavioral Specification Elicitation as a First-Class Step in Agent-Based Program Synthesis from Scratch Paper • 2607.27167 • Published 5 days ago • 18
MindForge: Teaching Small Language Models Whole-Life-Cycle Software Engineering via Source-Free Program Synthesis Paper • 2607.27146 • Published 5 days ago • 23
SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution Paper • 2607.26784 • Published 5 days ago • 25
CAST: Game Solvers as Turn-Level Teachers for LLM Agents Paper • 2607.25308 • Published 6 days ago • 40
CLBench-V: Evaluating Multimodal Context Learning from Grounding to Knowledge Acquisition Paper • 2607.25294 • Published 6 days ago • 44
DecoEvo: Score-Decoupled Co-Evolution of Solver and Rubric-Generator Skills in Text Space Paper • 2607.25675 • Published 6 days ago • 61
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy Optimization Paper • 2607.25659 • Published 6 days ago • 80
A New Role for Relevance: Guiding Corpus Interaction in Agentic Search Paper • 2607.24223 • Published 7 days ago • 92
TILT: Improving Compositional Generation in Diffusion Models with a Model-Intrinsic Reward Paper • 2607.21606 • Published May 16 • 3