DecepEval: A Benchmark for Evaluating Deception in LLM Agents Paper • 2610.07967 • Published 3 days ago • 67
KeyRec: Bounded Visual Memory for Streaming and Long-Video Understanding Paper • 2609.32182 • Published 13 days ago • 12
Self-supervised Quantized Representation for Seamlessly Integrating Knowledge Graphs with Large Language Models Paper • 2501.18119 • Published Jan 30, 2025 • 25