position-specialist-speculative-decoding/Speed-E3-Llama3.1-8B-Instruct-vllm 0.9B • Updated Jan 28 • 63 • 5
open-llm-leaderboard-old/details_xformAI__opt-125m-gqa-ub-6-best-for-KV-cache Updated Jan 23, 2024 • 428 • 8