Commit History

Add optional GLM-4.7-Flash Q8 and GPT-OSS-120B MXFP4 aliases
48f42a4
verified

ShoaibSSM commited on

Bound llama.cpp HTTP and compute threads; enable four slots
d861a68
verified

ShoaibSSM commited on

Add lazy two-model router and detached ngrok setup
350d99c
verified

ShoaibSSM commited on

Add pinned A100 Qwen API runtime and benchmark scripts
42b02cd
verified

ShoaibSSM commited on

initial commit
79d4d07
verified

ShoaibSSM commited on