Knowledge-Geometry Decoupling: Refreshable Pretrained Transfer for Streaming Recommendation Paper • 2608.02738 • Published 3 days ago • 38
AURORA-LM: Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling Paper • 2608.02602 • Published 3 days ago • 73
JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion Paper • 2608.03974 • Published 2 days ago • 77
LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks Paper • 2608.01964 • Published 3 days ago • 144
Progressive Agent Skill Generation via Reinforcement Learning Paper • 2608.01678 • Published 3 days ago • 56
N_0-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens Paper • 2607.23782 • Published 11 days ago • 61
Meshy T2: Fast Native Mesh Generation with Flow Matching Paper • 2607.28675 • Published 9 days ago • 53
From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement Paper • 2607.23802 • Published 11 days ago • 97
Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering Paper • 2607.28568 • Published 7 days ago • 180
SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution Paper • 2607.26784 • Published 8 days ago • 28
HumanCLAW: Can Vision-Language Models Act Through a Body? Paper • 2607.27180 • Published 8 days ago • 76
TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM Paper • 2607.27205 • Published 8 days ago • 139
A New Role for Relevance: Guiding Corpus Interaction in Agentic Search Paper • 2607.24223 • Published 10 days ago • 93
Pass the Baton: Trajectory-Relayed On-Policy Distillation Paper • 2607.26057 • Published 9 days ago • 33
view article Article The Engineering Handbook for GRPO + LoRA with Verl: Training Qwen2.5 on Multi-GPU Weyaxi • Jan 2 • 24
Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation Paper • 2607.24731 • Published 10 days ago • 76
From Proprietary to Open-Source: Bridging the Distribution Gap via Multi-Agent Protocol Distillation in Agentic Search Paper • 2607.24280 • Published 10 days ago • 82