benchmarking, inference, load-testing, evaluation, llm-serving
Open LLMs at 1, 25 and 100 concurrent users