Running Agents 437 Reward Bench Leaderboard 📐 437 Explore and compare model scores on RewardBench benchmarks
NousResearch/Nous-Hermes-2-Mixtral-8x7B-DPO Text Generation • 47B • Updated Apr 30, 2024 • 11.9k • 460
Running on CPU Upgrade 14.1k Open LLM Leaderboard 🏆 14.1k Track, rank and evaluate open LLMs and chatbots