Consensus as Privileged Context for Label-Free Self-Distillation Paper • 2607.13643 • Published Jul 15
Clarification as Supervision: Reinforcement Learning for Vision-Language Interfaces Paper • 2509.26594 • Published Sep 30, 2025
Language Agents Meet Causality -- Bridging LLMs and Causal World Models Paper • 2410.19923 • Published Oct 25, 2024
INT2.1: Towards Fine-Tunable Quantized Large Language Models with Error Correction through Low-Rank Adaptation Paper • 2306.08162 • Published Jun 13, 2023
VISION DIFFMASK: Faithful Interpretation of Vision Transformers with Differentiable Patch Masking Paper • 2304.06391 • Published Apr 13, 2023