Commit History

Add optional GLM-4.7-Flash Q8 and GPT-OSS-120B MXFP4 aliases
48f42a4
verified

ShoaibSSM commited on

Bound llama.cpp HTTP and compute threads; enable four slots
d861a68
verified

ShoaibSSM commited on

Add lazy two-model router and detached ngrok setup
350d99c
verified

ShoaibSSM commited on

Add pinned A100 Qwen API runtime and benchmark scripts
42b02cd
verified

ShoaibSSM commited on