

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

# Osservabilità
<a name="sagemaker-hyperpod-ray-observability"></a>

L'add-on SageMaker HyperPod Observability raccoglie le metriche di Ray e fornisce le dashboard Grafana per i carichi di lavoro di Ray. L'installazione del componente aggiuntivo utilizza un raccoglitore che analizza i Ray head pod, i worker pod e l'operatore. KubeRay Il raccoglitore scrive le metriche in Amazon Managed Service per Prometheus e le dashboard vengono importate in Amazon Managed Grafana. Salta la configurazione manuale di Prometheus e Grafana.

L'add-on non è specifico per Ray. Raccoglie inoltre le metriche del cluster per lo stato dell'hardware, l'utilizzo delle risorse e le prestazioni delle attività. Le fonti includono NVIDIA DCGM, gli esportatori di nodi Kubernetes, Elastic Fabric Adapter, i file system integrati e Kueue. Un'installazione copre i carichi di lavoro Ray e il cluster su cui vengono eseguiti.

Per la configurazione generale dell'osservabilità, vedere. [Osservabilità per il SageMaker HyperPod cluster Amazon orchestrato da Amazon EKS](sagemaker-hyperpod-eks-cluster-observability.md)

**Topics**
+ [Impostazione della raccolta di metriche Ray](sagemaker-hyperpod-ray-observability-setup.md)
+ [Dashboard Ray Grafana](sagemaker-hyperpod-ray-observability-dashboards.md)
+ [Riferimento alle metriche di Ray](sagemaker-hyperpod-ray-observability-metrics-reference.md)