MaziyarPanahi/Meta-Llama-3-70B-Instruct-GGUF Text Generation • 71B • Updated May 14, 2024 • 4.23k • 170
LLM in a flash: Efficient Large Language Model Inference with Limited Memory Paper • 2312.11514 • Published Dec 12, 2023 • 264