

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

# Analice las mejores prácticas con la habilidad de `administrar amazon-msk`
<a name="bestpractices-msk-skill"></a>

Esta `managing-amazon-msk` habilidad es una habilidad de [ agente de código abierto que se encuentra ](https://agentskills.io/home) en el sitio web de Agent Skills, del [AWS Agent Toolkit ](https://github.com/aws/agent-toolkit-for-aws) en adelante, y proporciona experiencia en el dominio GitHub necesario para operar los clústeres aprovisionados de Amazon MSK. Tras instalar la habilidad en un agente de codificación de MCP-compatible IA (por ejemploKiro,,Cursor, y otros)Claude Code, la habilidad permite al agente de IA ayudarlo a evaluar su clúster y sus clientes en función de las mejores prácticas, diagnosticar problemas operativos e implementar las configuraciones recomendadas para los corredores y clientes de Standard y Express. Kafka Esta habilidad codifica los conocimientos MSK-specific operativos que los modelos de IA de uso general suelen aplicar de forma incorrecta u omitir.

## Capacidades
<a name="bestpractices-msk-skill-capabilities"></a>

La habilidad abarca las siguientes áreas, cada una de las cuales se basa en las mejores prácticas documentadas en esta guía.


|  | Área de mejores prácticas | Qué le ayuda a hacer la habilidad | 
| --- | --- | --- | 
| 1 | [Prácticas recomendadas para agentes Standard](bestpractices.md)(Estándar) | Evalúe el recuento de particiones por agente, recomiende tamaños de instancia, evalúe num.io.threads y num.network.threads ajuste las instancias m5.4xl\+ y m7g.4xl\+ | 
| 2 | [Prácticas recomendadas para agentes Express](bestpractices-express.md)(Exprés) | Calcule el número de agentes necesario en función de los límites de rendimiento de cada agente, recomiende los tipos de instancias Express para el destino ingress/egress y evalúe el recuento de particiones en comparación con las cuotas de Express | 
| 3 | [Supervisisión del uso de CPU](bestpractices.md#bestpractices-monitor-cpu) | Diagnostique la saturación de los recursos de los agentes, distinga entre las causas principales y los errores de configuración del lado del bróker y del lado del cliente, y determine cuándo es necesario realizar el escalamiento | 
| 4 | [Monitorear el espacio en disco](bestpractices.md#bestpractices-monitor-disk-space) | Evalúe el uso del almacenamiento por parte de los agentes estándar, identifique los temas de mayor crecimiento y recomiende ajustes de expansión o retención de EBS. En el caso de Express, supervise la utilización del almacenamiento (el almacenamiento está totalmente gestionado) para optimizar los costos | 
| 5 | [Conexión a un clúster de Amazon MSK aprovisionado](client-access.md) | Audite los producer/consumer ajustes, configure la autenticación y ajuste para lograr una alta disponibilidad y tolerancia a fallos | 
| 6 | [Crear clústeres de alta disponibilidad](bestpractices.md#ensure-high-availability) | Verifique las configuraciones de alta disponibilidad y la implementación en zonas de disponibilidad múltiples para los agentes estándar, así como la configuración de conmutación por error de los clientes | 
| 7 | [Supervisión de un clúster de Amazon MSK aprovisionado](monitoring.md) | Cree CloudWatch paneles y alarmas para las métricas clave fundamentales para la observabilidad y las operaciones de Amazon MSK | 
| 8 | [Características y conceptos clave de Amazon MSK](operations.md) | Evalúe la preparación del clúster para las actualizaciones, comprenda el comportamiento de los parches entre Standard y Express y comprenda el impacto de los reinicios de los corredores en los clientes | 

## Funcionamiento
<a name="bestpractices-msk-skill-how-it-works"></a>

Cuando le haga a su agente de codificación de IA una pregunta sobre Amazon MSK, por ejemplo: «¿Por qué la CPU de mi clúster de MSK es alta?» o «Ayúdeme a configurar la supervisión de mi clúster Express»: la habilidad se activa y proporciona al agente:
+ **Flujos de trabajo de diagnóstico**: pasos estructurados para la solución de problemas en los que se comprueban primero las causas más probables (por ejemplo, realizar una verificación `linger.ms` antes de recomendar el escalado del broker para detectar problemas de CPU).
+ **Broker-type-aware orientación**: esta habilidad determina si el clúster utiliza agentes Standard o Express y aplica las métricas, los umbrales y las recomendaciones correctos para ese tipo de agente.
+ **AWS Comandos de la CLI**: Ready-to-run comandos para describir los clústeres, ampliar el almacenamiento, crear configuraciones y consultar métricas CloudWatch .
+ **Validación de las mejores prácticas**: comprueba la configuración del clúster comparándola con las recomendaciones documentadas y marca las desviaciones.

## Instalación
<a name="bestpractices-msk-skill-installation"></a>

### Opción 1: AWS CLI
<a name="bestpractices-msk-skill-install-cli"></a>

Requiere la versión 2.35.0 o posterior de la AWS CLI.

```
# Interactive setup (installs default skills + configures AWS MCP Server)
aws configure agent-toolkit

# Or install the skill individually
aws agent-toolkit add-skill --skill-name managing-amazon-msk
```

Para obtener la documentación completa de la CLI, consulte [ Administrar las habilidades con la AWS CLI. ](https://docs.aws.amazon.com/agent-toolkit/latest/userguide/aws-cli.html)

### Opción 2: AWS Servidor MCP
<a name="bestpractices-msk-skill-install-mcp"></a>

Conecte su agente de codificación de IA al servidor AWS MCP, que proporciona la habilidad junto con las capacidades de ejecución de la AWS API en un entorno aislado.

```
{
  "mcpServers": {
    "aws-mcp": {
      "command": "uvx",
      "args": [
        "mcp-proxy-for-aws==1.6.2",
        "https://aws-mcp.us-east-1.api.aws/mcp",
        "--metadata", "AWS_REGION=us-east-1"
      ]
    }
  }
}
```

Para obtener instrucciones de configuración completas, consulte [ Configuración del AWS servidor MCP. ](https://docs.aws.amazon.com/agent-toolkit/latest/userguide/getting-started-aws-mcp-server.html)

## Casos de uso y ejemplos
<a name="bestpractices-msk-skill-use-cases"></a>

### Evalúe las mejores prácticas de los corredores estándar
<a name="bestpractices-msk-skill-uc-standard"></a>

**Mensaje: ** «Tengo un clúster estándar de MSK que utiliza agentes kafka.m5.2xlarge con 2500 particiones por agente. ¿Estoy siguiendo las prácticas recomendadas?»

La habilidad:
+ Compare el recuento de particiones con el límite [ recomendado de 2000 particiones por intermediario ](bestpractices.md#partitions-per-broker) para m5.2xlarge.
+ Advierta que ha superado el recuento recomendado y que se acerca al máximo de 3000 que admite las operaciones de actualización.
+ Se recomienda reducir las particiones o actualizar a m5.4xlarge (que admite 4.000 particiones por intermediario).
+ Compruebe su `num.network.threads` configuración `num.io.threads` y recomiende realizar ajustes si su tamaño es insuficiente.

### Diagnostique el rendimiento del corredor Express
<a name="bestpractices-msk-skill-uc-express"></a>

**Mensaje: ** «Mi clúster de Express tiene 3 corredores express.m7g.large y estoy viendo que se están agotando. ¿Qué pasa?»

La habilidad:
+ Identifique que `express.m7g.large` admite [ 15,6 MBps de entrada y 31,2 MBps de salida por bróker. ](limits.md#msk-express-quota)
+ Pregunte por su rendimiento actual o ejecute una CloudWatch consulta para comprobarlo. `BytesInPerSec` `BytesOutPerSec`
+ Si el rendimiento supera los límites por agente, se recomienda ampliarlo `express.m7g.xlarge` o añadirlo.
+ Verificación `ProduceThrottleTime` y `FetchThrottleTime` métricas.

### Audite la configuración del cliente
<a name="bestpractices-msk-skill-uc-client"></a>

**Mensaje: ** «Revise mi configuración de productor de Kafka para conocer las mejores prácticas en MSK»

La habilidad:
+ Compruebe las configuraciones críticas`linger.ms`, como,,`acks`, y más `batch.size``buffer.memory`, para tener en cuenta las consideraciones de rendimiento y durabilidad.
+ Proporcione recomendaciones para su escenario a fin de ajustar las configuraciones, mejorar el rendimiento y garantizar una alta disponibilidad.

### Configure la supervisión y las alarmas
<a name="bestpractices-msk-skill-uc-monitoring"></a>

**Mensaje: ** «Ayúdeme a configurar la CloudWatch supervisión de mi clúster de MSK siguiendo las prácticas recomendadas»

La habilidad:
+ Cree alarmas para métricas críticas como la utilización de la CPU (`CpuUser + CpuSystem`) y otras para monitorear la saturación de los corredores. `RequestHandlerAvgIdlePercent`
+ Para Standard: añada `KafkaDataLogsDiskUsed > 85%` alarma y `UnderReplicatedPartitions > 0` alarma.
+ Para Express: añada la `StorageUsed` supervisión para optimizar los costos.
+ Configure paneles por agente, por tema y por grupo de consumidores.

## Código fuente y contribuciones
<a name="bestpractices-msk-skill-source"></a>

La `managing-amazon-msk` habilidad es de código abierto. Puedes revisar el código fuente, sugerir mejoras o aportar nuevas funciones.
+ **GitHub: ** [ aws/agent -toolkit-for-aws ](https://github.com/aws/agent-toolkit-for-aws/tree/main/skills/specialized-skills/analytics-skills/managing-amazon-msk) en GitHub

Los comentarios sobre otros escenarios de mejores prácticas, nuevos casos de uso o correcciones son bienvenidos a través GitHub de problemas o solicitudes de cambios.