Persona Dosing: Calibrated Activation Steering for Graded Trait Control Paper • 2609.36388 • Published 5 days ago • 2
Transformers Stop Thinking Too Early, and a Tiny LoRA Fixes It Paper • 2609.36585 • Published 4 days ago • 2
S3Gym: Can LLMs Turn Self-Testing and Self-Judging into Self-Improvement? Paper • 2608.31100 • Published Aug 31 • 114
HarnessDev: Can LLMs Create and Evolve Their Own Agent Harness? Paper • 2609.01437 • Published Sep 1 • 294
How Far Are VLMs from Privacy Awareness in the Physical World? An Empirical Study Paper • 2605.05340 • Published May 8 • 2
Beyond Steering Vector: Flow-based Activation Steering for Inference-Time Intervention Paper • 2605.05892 • Published May 7 • 1