|
Download .venv/transformers/docs/source/it/perf_infer_gpu_many.md from DrDavis/PythonProject1: direct link, hf CLI and curl.
- Browser
- Download file 1.42 kB
-
https://huggingface.co/DrDavis/PythonProject1/resolve/main/.venv/transformers/docs/source/it/perf_infer_gpu_many.md
- Command line
-
hf download hf://DrDavis/PythonProject1/.venv/transformers/docs/source/it/perf_infer_gpu_many.md
-
curl -L -o perf_infer_gpu_many.md https://huggingface.co/DrDavis/PythonProject1/resolve/main/.venv/transformers/docs/source/it/perf_infer_gpu_many.md
1.42 kB
Inferenza Efficiente su GPU Multiple
Questo documento contiene informazioni su come fare inferenza in maniera efficiente su GPU multiple.
Nota: Un setup con GPU multiple può utilizzare la maggior parte delle strategie descritte nella sezione con GPU singola. Tuttavia, è necessario conoscere delle tecniche semplici che possono essere utilizzate per un risultato migliore.
BetterTransformer per inferenza più rapida
Abbiamo recentemente integrato BetterTransformer per inferenza più rapida su multi-GPU per modelli su testo, immagini e audio. Controlla il documento con queste integrazioni qui per maggiori dettagli.