View a markdown version of this page

Analice las mejores prácticas con la habilidad de administrar amazon-msk - Transmisión administrada de Amazon para Apache Kafka

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Analice las mejores prácticas con la habilidad de administrar amazon-msk

Esta managing-amazon-msk habilidad es una habilidad de agente de código abierto que se encuentra en el sitio web de Agent Skills, del AWS Agent Toolkit en adelante, y proporciona experiencia en el dominio GitHub necesario para operar los clústeres aprovisionados de Amazon MSK. Tras instalar la habilidad en un agente de codificación de MCP-compatible IA (por ejemploKiro,,Cursor, y otros)Claude Code, la habilidad permite al agente de IA ayudarlo a evaluar su clúster y sus clientes en función de las mejores prácticas, diagnosticar problemas operativos e implementar las configuraciones recomendadas para los corredores y clientes de Standard y Express. Kafka Esta habilidad codifica los conocimientos MSK-specific operativos que los modelos de IA de uso general suelen aplicar de forma incorrecta u omitir.

Capacidades

La habilidad abarca las siguientes áreas, cada una de las cuales se basa en las mejores prácticas documentadas en esta guía.

Área de mejores prácticas Qué le ayuda a hacer la habilidad
1 Prácticas recomendadas para agentes Standard(Estándar) Evalúe el recuento de particiones por agente, recomiende tamaños de instancia, evalúe num.io.threads y num.network.threads ajuste las instancias m5.4xl+ y m7g.4xl+
2 Prácticas recomendadas para agentes Express(Expreso) Calcule el número de agentes necesario en función de los límites de rendimiento de cada agente, recomiende los tipos de instancias Express para el destino ingress/egress y evalúe el recuento de particiones en comparación con las cuotas de Express
3 Supervisisión del uso de CPU Diagnostique la saturación de los recursos de los agentes, distinga entre las causas principales y los errores de configuración del lado del bróker y del lado del cliente, y determine cuándo es necesario escalar
4 Monitorear el espacio en disco Evalúe el uso del almacenamiento por parte de los agentes estándar, identifique los temas de mayor crecimiento y recomiende ajustes de expansión o retención de EBS. En el caso de Express, supervise la utilización del almacenamiento (el almacenamiento está totalmente gestionado) para optimizar los costos
5 Conexión a un clúster de Amazon MSK aprovisionado Audite los producer/consumer ajustes, configure la autenticación y ajuste para lograr una alta disponibilidad y tolerancia a fallos
6 Crear clústeres de alta disponibilidad Verifique las configuraciones de alta disponibilidad y la implementación en zonas de disponibilidad múltiples para los agentes estándar, así como la configuración de conmutación por error de los clientes
7 Supervisión de un clúster de Amazon MSK aprovisionado Cree CloudWatch paneles y alarmas para las métricas clave fundamentales para la observabilidad y las operaciones de Amazon MSK
8 Características y conceptos clave de Amazon MSK Evalúe la preparación del clúster para las actualizaciones, comprenda el comportamiento de los parches entre Standard y Express y comprenda el impacto de los reinicios de los corredores en los clientes

Funcionamiento

Cuando le haga a su agente de codificación de IA una pregunta sobre Amazon MSK, por ejemplo: «¿Por qué la CPU de mi clúster de MSK es alta?» o «Ayúdeme a configurar la supervisión de mi clúster Express»: la habilidad se activa y proporciona al agente:

  • Flujos de trabajo de diagnóstico: pasos estructurados para la solución de problemas en los que se comprueban primero las causas más probables (por ejemplo, realizar una verificación linger.ms antes de recomendar el escalado del broker para detectar problemas de CPU).

  • Broker-type-aware orientación: esta habilidad determina si el clúster utiliza agentes Standard o Express y aplica las métricas, los umbrales y las recomendaciones correctos para ese tipo de agente.

  • AWS Comandos de la CLI: Ready-to-run comandos para describir los clústeres, ampliar el almacenamiento, crear configuraciones y consultar métricas CloudWatch .

  • Validación de las mejores prácticas: comprueba la configuración del clúster comparándola con las recomendaciones documentadas y marca las desviaciones.

Instalación

Opción 1: AWS CLI

Requiere la versión 2.35.0 o posterior de la AWS CLI.

# Interactive setup (installs default skills + configures AWS MCP Server) aws configure agent-toolkit # Or install the skill individually aws agent-toolkit add-skill --skill-name managing-amazon-msk

Para obtener la documentación completa de la CLI, consulte Administrar las habilidades con la AWS CLI.

Opción 2: AWS Servidor MCP

Conecte su agente de codificación de IA al servidor AWS MCP, que proporciona la habilidad junto con las capacidades de ejecución de la AWS API en un entorno aislado.

{ "mcpServers": { "aws-mcp": { "command": "uvx", "args": [ "mcp-proxy-for-aws==1.6.2", "https://aws-mcp.us-east-1.api.aws/mcp", "--metadata", "AWS_REGION=us-east-1" ] } } }

Para obtener instrucciones de configuración completas, consulte Configuración del AWS servidor MCP.

Casos de uso y ejemplos

Evalúe las mejores prácticas de los corredores estándar

Mensaje: «Tengo un clúster estándar de MSK que utiliza agentes kafka.m5.2xlarge con 2500 particiones por agente. ¿Estoy siguiendo las prácticas recomendadas?»

La habilidad:

  • Compare el recuento de particiones con el límite recomendado de 2000 particiones por intermediario para m5.2xlarge.

  • Advierta que ha superado el recuento recomendado y que se acerca al máximo de 3000 que admite las operaciones de actualización.

  • Se recomienda reducir las particiones o actualizar a m5.4xlarge (que admite 4.000 particiones por intermediario).

  • Compruebe su num.network.threads configuración num.io.threads y recomiende realizar ajustes si su tamaño es insuficiente.

Diagnostique el rendimiento del corredor Express

Aviso: «Mi clúster de Express tiene 3 corredores de Express.m7g.large y estoy viendo que se están agotando. ¿Qué pasa?»

La habilidad:

  • Identifique que express.m7g.large admite 15,6 MBps de entrada y 31,2 MBps de salida por bróker.

  • Pregunte por su rendimiento actual o ejecute una CloudWatch consulta para comprobarlo. BytesInPerSec BytesOutPerSec

  • Si el rendimiento supera los límites por agente, se recomienda ampliarlo express.m7g.xlarge o añadirlo.

  • Verificación ProduceThrottleTime y FetchThrottleTime métricas.

Audite la configuración del cliente

Mensaje: «Revise mi configuración de productor de Kafka para conocer las mejores prácticas en MSK»

La habilidad:

  • Compruebe las configuraciones críticaslinger.ms, como,,acks, y más batch.sizebuffer.memory, para tener en cuenta las consideraciones de rendimiento y durabilidad.

  • Proporcione recomendaciones para su escenario a fin de ajustar las configuraciones, mejorar el rendimiento y garantizar una alta disponibilidad.

Configure la supervisión y las alarmas

Mensaje: «Ayúdeme a configurar la CloudWatch supervisión de mi clúster de MSK siguiendo las prácticas recomendadas»

La habilidad:

  • Cree alarmas para métricas críticas como la utilización de la CPU (CpuUser + CpuSystem) y otras para monitorear la saturación de los corredores. RequestHandlerAvgIdlePercent

  • Para la versión estándar: añada KafkaDataLogsDiskUsed > 85% una alarma y UnderReplicatedPartitions > 0 una alarma.

  • Para Express: añada la StorageUsed supervisión para optimizar los costos.

  • Configure paneles por agente, por tema y por grupo de consumidores.

Código fuente y contribuciones

La managing-amazon-msk habilidad es de código abierto. Puedes revisar el código fuente, sugerir mejoras o aportar nuevas funciones.

Los comentarios sobre otros escenarios de mejores prácticas, nuevos casos de uso o correcciones son bienvenidos a través GitHub de problemas o solicitudes de cambios.