File size: 705 Bytes
a4c799c
c6f9ed8
a4c799c
c6f9ed8
a4c799c
c6f9ed8
a4c799c
 
 
 
 
c6f9ed8
a4c799c
c6f9ed8
a4c799c
 
 
c6f9ed8
a4c799c
c6f9ed8
a4c799c
 
 
 
 
c6f9ed8
a4c799c
c6f9ed8
96abf03
a4c799c
96abf03
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
# K2Horizon llama.cpp CUDA Binary

Pre-built llama.cpp binary with CUDA support for Linux x86_64.

## Repository

- Source: https://github.com/MBZUAI-IFM/llama.cpp
- Branch: model/K2Horizon
- Version: 0.3.0-dev
- Build: 10671
- Commit: 35999d101

## Requirements

- Linux x86_64
- NVIDIA GPU with CUDA support
- CUDA 12.8+

## Files

| File | Description |
|------|-------------|
| `llama-k2horizon-cuda-linux-x64.tar.gz` | K2Horizon llama.cpp CUDA binary |
| `llama.cpp-b9628-cuda-12.8-amd64.tar.gz` | llama.cpp build b9628 for CUDA 12.8 |
| `sageattention-2.2.0-cp312-cp312-linux_x86_64.whl` | SageAttention 2.2.0 pre-built wheel |

## Install

```bash
tar xzf llama-k2horizon-cuda-linux-x64.tar.gz
```