View a markdown version of this page

Caratteristiche principali della SageMaker Model Parallelism Library - Amazon SageMaker AI

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Caratteristiche principali della SageMaker Model Parallelism Library

La libreria di parallelismo dei modelli di Amazon SageMaker AI offre strategie di distribuzione e tecniche di risparmio di memoria, come il parallelismo dei dati frammentati, il parallelismo tensoriale, il partizionamento del modello per livelli per la pianificazione delle pipeline e il checkpoint. Le strategie e le tecniche di parallelismo dei modelli aiutano a distribuire modelli di grandi dimensioni su più dispositivi, ottimizzando al contempo la velocità di addestramento e il consumo di memoria. La libreria fornisce anche funzioni di supporto in Python, gestori di contesto e funzioni wrapper per adattare lo script di addestramento per il partizionamento automatico o manuale del modello.

Quando implementi il parallelismo dei modelli nel tuo processo di formazione, mantieni lo stesso flusso di lavoro in due fasi mostrato nella sezione Run a Distributed Training Job with Model Parallelism. SageMaker Per adattare lo script di addestramento, aggiungerete zero o poche righe di codice aggiuntive allo script di addestramento. Per avviare un processo di addestramento dello script di addestramento adattato, è necessario impostare i parametri di configurazione della distribuzione per attivare le funzioni di risparmio di memoria o per trasmettere i valori relativi al grado di parallelismo.

Per iniziare con degli esempi, consultate i seguenti taccuini Jupyter che dimostrano come utilizzare la libreria di parallelismo dei modelli. SageMaker

Per approfondire le caratteristiche principali della libreria, consulta i seguenti argomenti.

Nota

Le librerie di formazione SageMaker distribuite sono disponibili tramite i contenitori di AWS deep learning di Hugging Face e TensorFlow all'interno della piattaforma Training. PyTorch SageMaker Per utilizzare le funzionalità delle librerie di formazione distribuite, ti consigliamo di utilizzare Python SDK. SageMaker Puoi anche configurare manualmente la sintassi della richiesta JSON se utilizzi le SageMaker API tramite SDK for Python (Boto3) o. AWS Command Line Interface In tutta la documentazione, le istruzioni e gli esempi si concentrano su come utilizzare le librerie di formazione distribuite con Python SDK. SageMaker

Importante

La libreria di parallelismo dei SageMaker modelli supporta tutte le funzionalità principali e supporta il parallelismo delle PyTorch pipeline per. TensorFlow