Multi-Head Explainer: A General Framework to Improve Explainability in CNNs and Transformers Paper • 2501.01311 • Published Jan 2, 2025 • 1
The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models Paper • 2605.24697 • Published May 23 • 3