Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning Paper • 2606.31825 • Published 27 days ago • 29
Ko-WideSearch: A Korean Breadth-Search Benchmark for Exhaustive Set Enumeration by Web Agents Paper • 2606.27595 • Published Jun 25 • 8
OpenBioRQ: Unsolved Biomedical Research Questions for Agents Paper • 2606.21959 • Published Jun 20 • 4
Rare Tokens Degenerate All Tokens: Improving Neural Text Generation via Adaptive Gradient Gating for Rare Token Embeddings Paper • 2109.03127 • Published Sep 7, 2021
Correcting Negative Bias in Large Language Models through Negative Attention Score Alignment Paper • 2408.00137 • Published Jul 31, 2024
Interactive Text-to-Image Retrieval with Large Language Models: A Plug-and-Play Approach Paper • 2406.03411 • Published Jun 5, 2024
Contextualized Visual Personalization in Vision-Language Models Paper • 2602.03454 • Published Feb 3 • 3
Controlled Text Generation for Black-box Language Models via Score-based Progressive Editor Paper • 2311.07430 • Published Nov 13, 2023
Unleashing Multi-Hop Reasoning Potential in Large Language Models through Repetition of Misordered Context Paper • 2410.07103 • Published Oct 9, 2024
Knowledge Integration Decay in Search-Augmented Reasoning of Large Language Models Paper • 2602.09517 • Published Feb 10 • 1
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling Paper • 2312.15166 • Published Dec 23, 2023 • 62
Evalverse: Unified and Accessible Library for Large Language Model Evaluation Paper • 2404.00943 • Published Apr 1, 2024 • 1