Add optional GLM-4.7-Flash Q8 and GPT-OSS-120B MXFP4 aliases 48f42a4 verified ShoaibSSM commited on 8 days ago
Bound llama.cpp HTTP and compute threads; enable four slots d861a68 verified ShoaibSSM commited on 8 days ago
Add pinned A100 Qwen API runtime and benchmark scripts 42b02cd verified ShoaibSSM commited on 8 days ago