StealthBench: Measuring Operational Stealth in Autonomous Offensive-Security Agents Paper • 2607.26314 • Published 3 days ago • 2
AIRTBench: Measuring Autonomous AI Red Teaming Capabilities in Language Models Paper • 2506.14682 • Published Jun 17, 2025
MAIF: Enforcing AI Trust and Provenance with an Artifact-Centric Agentic Paradigm Paper • 2511.15097 • Published Nov 19, 2025
Llama-3.1-FoundationAI-SecurityLLM-Base-8B Technical Report Paper • 2504.21039 • Published Apr 28, 2025 • 19