VGGT-Diff: Visual Geometry Meets Diffusion for Sparse-View Novel View Synthesis Paper • 2609.33253 • Published 4 days ago • 3
TeleOCR Collection TeleOCR parses scans, PDFs and photos, supporting complex layouts, tables, formulas and charts. OmniDocBench V1.6 (96.87) and Wild-OmniDocBenc(88.53). • 1 item • Updated 3 days ago • 1
ExtractBench: A Benchmark for Schema-Guided Enterprise Document Extraction Paper • 2607.29677 • Published Jul 31 • 26
WhatWorkedBench: Benchmarking Experimental Understanding in AI Agents Paper • 2609.27490 • Published 8 days ago • 14
ZipTok3D: High-Fidelity 3D Tokenization with Compact Token Prefixes Paper • 2609.01740 • Published 30 days ago • 29
LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation Paper • 2608.30935 • Published about 1 month ago • 33
Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion Paper • 2608.19567 • Published Aug 20 • 34
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design Paper • 2603.28376 • Published Mar 30 • 22
Ovis-Embedding: Pushing the Frontiers of Universal Omni-Modal Embeddings Paper • 2609.25165 • Published 10 days ago • 75
view article Article KV Caching Explained: Optimizing Transformer Inference Efficiency not-lain • Jan 30, 2025 • 422
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions Paper • 2609.04199 • Published 28 days ago • 333