Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
Addestra un modello con Amazon SageMaker
Amazon SageMaker Training è un servizio di machine learning (ML) completamente gestito offerto da SageMaker che consente di addestrare in modo efficiente un'ampia gamma di modelli ML su larga scala. Il fulcro dei lavori di SageMaker intelligenza artificiale è la containerizzazione dei carichi di lavoro ML e la capacità di gestire AWS le risorse di calcolo. La piattaforma di SageMaker formazione si occupa delle attività gravose associate alla configurazione e alla gestione dell'infrastruttura per i carichi di lavoro di formazione ML. Con SageMaker Training, puoi concentrarti sullo sviluppo, sulla formazione e sulla messa a punto del tuo modello. Questa pagina presenta tre modi consigliati per iniziare ad addestrare un modello SageMaker, seguiti da opzioni aggiuntive che puoi prendere in considerazione.
Suggerimento
Per informazioni sulla formazione dei modelli base per l'intelligenza artificiale generativa, consulta Utilizzare i modelli di SageMaker JumpStart base in Amazon SageMaker Studio.
Scelta di una funzionalità all'interno di Amazon Training SageMaker
Esistono tre casi d'uso principali per l'addestramento di modelli ML all'interno dell' SageMaker IA. Questa sezione descrive questi casi d'uso e le funzionalità di SageMaker intelligenza artificiale consigliate per ogni caso d'uso.
Che stiate addestrando modelli di deep learning complessi o implementando algoritmi di machine learning più piccoli, il SageMaker Training fornisce soluzioni semplificate ed economiche che soddisfano i requisiti dei vostri casi d'uso.
Casi d’uso
Di seguito sono riportati i principali casi d'uso per l'addestramento di modelli ML all'interno dell'IA. SageMaker
-
Caso d’uso 1: sviluppare un modello di machine learning in un ambiente low code o no code.
-
Caso d’uso 2: utilizzare codice per sviluppare modelli di machine learning con livelli maggiori di flessibilità e controllo.
-
Caso d’uso 3: sviluppare modelli di machine learning su larga scala con livelli massimi di flessibilità e controllo.
Funzionalità consigliate
La tabella seguente descrive tre scenari comuni di addestramento dei modelli ML e le opzioni corrispondenti per iniziare con il SageMaker Training.
| Descrittore | Caso d'uso 1 | Caso d'uso 2 | Caso d'uso 3 |
|---|---|---|---|
| SageMaker Funzionalità AI | Crea un modello utilizzando Amazon SageMaker Canvas. | Addestra un modello utilizzando uno degli algoritmi ML integrati nell'SageMaker intelligenza artificiale come XGBoost o Task-Specific Models by SageMaker JumpStart con l' SageMaker SDK Python. | Addestra un modello su larga scala con la massima flessibilità sfruttando la modalità https://sagemaker-examples.readthedocs.io/en/latest/sagemaker-script-mode/sagemaker-script-mode.html |
| Description | Porta i tuoi dati. SageMaker L'intelligenza artificiale aiuta a gestire la creazione di modelli ML e a configurare l'infrastruttura e le risorse di formazione. |
Raccogli i tuoi dati e scegli uno degli algoritmi ML integrati forniti dall' SageMaker IA. Configura gli iperparametri del modello, le metriche di output e le impostazioni di base dell'infrastruttura utilizzando Python SDK. SageMaker La piattaforma di SageMaker formazione aiuta a fornire l'infrastruttura e le risorse di formazione. |
Sviluppa il tuo codice ML e trasferiscilo come script o set di script nell' SageMaker IA. Per saperne di più, consulta la sezione Elaborazione distribuita con le SageMaker migliori pratiche. Inoltre, è possibile utilizzare il proprio container Docker. La piattaforma di SageMaker formazione aiuta a fornire l'infrastruttura e le risorse di formazione su larga scala in base alle impostazioni personalizzate. |
| Ottimizzazione per |
Low/no-code e sviluppo di UI-driven modelli con rapida sperimentazione con un set di dati di formazione. In fase di creazione di un modello personalizzato, un algoritmo viene selezionato automaticamente in base ai dati. Per opzioni di personalizzazione avanzate come la selezione degli algoritmi, consulta Advanced Model Building Configurations. |
Addestramento di modelli ML con personalizzazione di alto livello per iperparametri, impostazioni dell’infrastruttura e possibilità di utilizzare direttamente framework ML e script del punto di ingresso per una maggiore flessibilità. Usa algoritmi integrati, modelli e modelli pre-addestrati tramite Amazon SageMaker Python SDK |
Carichi di lavoro di addestramento ML su larga scala, che richiedono più istanze e massima flessibilità. Scopri l'elaborazione distribuita con SageMaker le migliori pratiche. SageMaker L'intelligenza artificiale utilizza le immagini Docker per ospitare l'addestramento e la gestione di tutti i modelli. Puoi utilizzare qualsiasi algoritmo di SageMaker intelligenza artificiale o esterno e utilizzare i contenitori Docker per creare modelli. |
| Considerazioni |
Flessibilità minima per personalizzare il modello fornito da Amazon SageMaker Canvas. |
L'SDK SageMaker Python fornisce un'interfaccia semplificata e un numero inferiore di opzioni di configurazione rispetto all'API Training di basso livello SageMaker . |
Richiede la conoscenza dell' AWS infrastruttura e delle opzioni di formazione distribuite. Consulta anche Crea il tuo contenitore di formazione utilizzando il toolkit SageMaker di formazione. |
| Ambiente consigliato | Usa Amazon SageMaker Canvas. Per informazioni su come configurarlo, consulta Guida introduttiva all'uso di SageMaker Canvas. | Usa l'SageMaker intelligenza artificiale JupyterLab in Amazon SageMaker Studio. Per informazioni su come configurarlo, consulta Launch Amazon SageMaker Studio. | Utilizzalo SageMaker JupyterLab all'interno di Amazon SageMaker Studio. Per informazioni su come configurarlo, consulta Launch Amazon SageMaker Studio. |
Opzioni aggiuntive
SageMaker L'intelligenza artificiale offre le seguenti opzioni aggiuntive per l'addestramento dei modelli ML.
SageMaker Funzionalità di intelligenza artificiale che offrono funzionalità di formazione
-
SageMaker JumpStart: SageMaker JumpStart fornisce l'accesso all' SageMaker AI public model hub che contiene i più recenti modelli di base (FM) proprietari e disponibili al pubblico. Puoi mettere a punto, valutare e distribuire questi modelli all'interno di Amazon Studio. SageMaker SageMaker JumpStart semplifica il processo di utilizzo dei modelli di base per i casi d'uso dell'IA generativa e consente di creare hub di modelli privati per utilizzare i modelli di base, applicando al contempo le barriere di governance e garantendo che l'organizzazione possa accedere solo ai modelli approvati. Per iniziare, consulta Foundation Models. SageMaker JumpStart SageMaker JumpStart
-
SageMaker HyperPod: SageMaker HyperPod è un servizio di cluster persistente per casi d'uso che richiedono cluster resilienti per massicci carichi di lavoro di machine learning (ML) e per lo sviluppo di modelli di base (FM) all'avanguardia. Accelera lo sviluppo di tali modelli eliminando gli oneri indifferenziati legati alla creazione e alla manutenzione di cluster di calcolo su larga scala alimentati da migliaia di acceleratori come Trainium o unità di elaborazione grafica (GPU) NVIDIA A100 e H100. AWS Puoi utilizzare un software di gestione dei carichi HyperPod di lavoro come Slurm on.
Altre funzionalità di Training SageMaker
-
Ottimizzazione degli iperparametri : questa funzionalità di SageMaker intelligenza artificiale aiuta a definire un set di iperparametri per un modello e ad avviare molti lavori di addestramento su un set di dati. A seconda dei valori degli iperparametri, le prestazioni di addestramento dei modelli possono variare. Questa funzionalità fornisce il set di iperparametri con le migliori prestazioni entro l’intervallo specificato di iperparametri impostati per la ricerca.
-
Formazione distribuita : Pre-train oppure perfeziona le FM create con PyTorch, NVIDIA CUDA e altri framework. PyTorch-based Per utilizzare in modo efficiente le istanze GPU, utilizza le librerie di formazione distribuite con SageMaker intelligenza artificiale che offrono operazioni di comunicazione collettiva e varie tecniche di parallelismo dei modelli, come il parallelismo esperto e il parallelismo dei dati condivisi, ottimizzate per l'infrastruttura. AWS
-
Funzionalità di osservabilità: utilizza le funzionalità di profilazione e debug di Training per ottenere informazioni dettagliate sui carichi di lavoro di SageMaker addestramento dei modelli, sulle prestazioni dei modelli e sull'utilizzo delle risorse. Per ulteriori informazioni, consulta Esegui il debug e migliora le prestazioni del modello e Profilazione e ottimizzazione delle prestazioni di calcolo.
-
Cost-saving e opzioni di istanza efficienti: per ottimizzare i costi e l'efficienza di calcolo per il provisioning delle istanze di formazione, utilizza Heterogeneous Cluster, Managed Spot instances o Managed Warm Pools. https://docs.aws.amazon.com/sagemaker/latest/dg/model-managed-spot-training.html https://docs.aws.amazon.com/sagemaker/latest/dg/train-warm-pools.html