view article Compute:Arena / Measuring Local Inference Across Models, Quants, Chips, and Runtimes
basecompute
• • 6
view article Base Optimization Stack: From Open Weights to Frontier On-Device Inference Speed
view article BaseRT: Best-in-Class LLM Inference on Apple Silicon via Native Metal