File size: 705 Bytes
a4c799c c6f9ed8 a4c799c c6f9ed8 a4c799c c6f9ed8 a4c799c c6f9ed8 a4c799c c6f9ed8 a4c799c c6f9ed8 a4c799c c6f9ed8 a4c799c c6f9ed8 a4c799c c6f9ed8 96abf03 a4c799c 96abf03 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 | # K2Horizon llama.cpp CUDA Binary
Pre-built llama.cpp binary with CUDA support for Linux x86_64.
## Repository
- Source: https://github.com/MBZUAI-IFM/llama.cpp
- Branch: model/K2Horizon
- Version: 0.3.0-dev
- Build: 10671
- Commit: 35999d101
## Requirements
- Linux x86_64
- NVIDIA GPU with CUDA support
- CUDA 12.8+
## Files
| File | Description |
|------|-------------|
| `llama-k2horizon-cuda-linux-x64.tar.gz` | K2Horizon llama.cpp CUDA binary |
| `llama.cpp-b9628-cuda-12.8-amd64.tar.gz` | llama.cpp build b9628 for CUDA 12.8 |
| `sageattention-2.2.0-cp312-cp312-linux_x86_64.whl` | SageAttention 2.2.0 pre-built wheel |
## Install
```bash
tar xzf llama-k2horizon-cuda-linux-x64.tar.gz
```
|