mirror of https://github.com/huggingface/transformers.git synced 2025-07-04 13:20:12 +06:00

Migrate doc files to Markdown. (#24376 )

* Rename index.mdx to index.md

* With saved modifs

* Address review comment

* Treat all files

* .mdx -> .md

* Remove special char

* Update utils/tests_fetcher.py

Co-authored-by: Lysandre Debut <lysandre.debut@reseau.eseo.fr>

---------

Co-authored-by: Lysandre Debut <lysandre.debut@reseau.eseo.fr>

2023-06-20 18:07:47 -04:00

1.4 KiB

Raw Blame History

Inferenza Efficiente su GPU Multiple

Questo documento contiene informazioni su come fare inferenza in maniera efficiente su GPU multiple.

Nota: Un setup con GPU multiple può utilizzare la maggior parte delle strategie descritte nella sezione con GPU singola. Tuttavia, è necessario conoscere delle tecniche semplici che possono essere utilizzate per un risultato migliore.

`BetterTransformer` per inferenza più rapida

Abbiamo recentemente integrato BetterTransformer per inferenza più rapida su multi-GPU per modelli su testo, immagini e audio. Controlla il documento con queste integrazioni qui per maggiori dettagli.

1.4 KiB Raw Blame History

Inferenza Efficiente su GPU Multiple

BetterTransformer per inferenza più rapida

1.4 KiB

Raw Blame History

`BetterTransformer` per inferenza più rapida