Rishabh Maheshwary
rmahesh
AI & ML interests
NLP, Multimodal vision and language, AI robustness and safety
Recent Activity
upvoted a paper about 1 month ago
AgentJudgeBench: A Multi-Difficulty Benchmark for Evaluating LLM Judges on Agentic Tool-Calling upvoted a collection about 2 months ago
💫StarShell upvoted a paper 3 months ago
SynthDocBench: Controlled Benchmark for Long-Context Visual Document Understanding