Evaluating LLM-Based 0-to-1 Software Generation in End-to-End CLI Tool Scenarios Paper • 2604.06742 • Published Apr 8 • 2
Repo2Run: Automated Building Executable Environment for Code Repository at Scale Paper • 2502.13681 • Published Oct 19, 2025
Benchmarking LLMs for Fine-Grained Code Review with Enriched Context in Practice Paper • 2511.07017 • Published Nov 10, 2025 • 1
Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling Paper • 2507.23370 • Published Jul 31, 2025 • 2
RepoMasterEval: Evaluating Code Completion via Real-World Repositories Paper • 2408.03519 • Published Aug 7, 2024 • 2
AEGIS: An Agent-based Framework for General Bug Reproduction from Issue Descriptions Paper • 2411.18015 • Published Nov 27, 2024 • 2
A Repository-Level Dataset For Detecting, Classifying and Repairing Software Vulnerabilities Paper • 2401.13169 • Published Jan 24, 2024
Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling Paper • 2507.23370 • Published Jul 31, 2025 • 2
RepoMasterEval: Evaluating Code Completion via Real-World Repositories Paper • 2408.03519 • Published Aug 7, 2024 • 2
AEGIS: An Agent-based Framework for General Bug Reproduction from Issue Descriptions Paper • 2411.18015 • Published Nov 27, 2024 • 2
Benchmarking LLMs for Fine-Grained Code Review with Enriched Context in Practice Paper • 2511.07017 • Published Nov 10, 2025 • 1
Evaluating LLM-Based 0-to-1 Software Generation in End-to-End CLI Tool Scenarios Paper • 2604.06742 • Published Apr 8 • 2
See Less, See Right: Bi-directional Perceptual Shaping For Multimodal Reasoning Paper • 2512.22120 • Published Dec 26, 2025 • 15
Paper2Poster: Towards Multimodal Poster Automation from Scientific Papers Paper • 2505.21497 • Published May 27, 2025 • 110