RelightFormer: Feed-forward Generative Transformer for Multiview Object Relighting Paper • 2609.07414 • Published 19 days ago • 11
LatentPress: Context Compression Beyond Text and Vision Paper • 2609.01507 • Published 25 days ago • 120
Scaling Creative Writing Beyond Story-Centric Data with Attribute-Guided Genre Expansion Paper • 2608.13947 • Published Aug 14 • 15
VectraYX-Vision-1B: A Sub-2B Spanish/LATAM Cybersecurity Vision-Language Model with Structured Visual Reasoning and Native Tool Use Paper • 2608.08477 • Published Aug 9 • 6
PAST-Bench: Benchmarking the Foundations of Recursive Self-Improvement in Personal Agents Paper • 2608.04003 • Published Aug 4 • 36
SwanTale: Unified Multi-Speaker Speech and Audio Generation for Instruct and Zero-Shot Tasks Paper • 2608.02023 • Published Aug 3 • 161