Saltar al contenido

¿Por qué se ha producido un reinicio de mi instancia de Linux de Amazon EC2?

5 minutos de lectura
0

Quiero saber por qué mi instancia de Linux de Amazon Elastic Compute Cloud (Amazon EC2) vuelve a arrancar o se reinicia inesperadamente.

Descripción corta

Es posible que la instancia se reinicie inesperadamente por los siguientes motivos:

  • La instancia no ha pasado las comprobaciones de estado.
  • Hay un problema con el hardware subyacente que aloja la instancia y Amazon EC2 la ha reiniciado para trasladarla a un hardware en buen estado.
  • El mantenimiento programado de la instancia provoca un reinicio.
  • Un usuario o una aplicación del servidor ha reiniciado la instancia.
  • Hay un error en el kernel.
  • Activaste la instancia de reinicio durante la creación de la imagen de máquina de Amazon (AMI).
  • AWS Systems Manager reinició una instancia gestionada.

Resolución

Nota: Si se muestran errores al ejecutar comandos de la Interfaz de la línea de comandos de AWS (AWS CLI), consulta Solución de problemas de AWS CLI. Además, asegúrate de utilizar la versión más reciente de AWS CLI.

Revisión del panel de Health

El panel de AWS Health informa sobre los eventos de reinicio de varias instancias, como la recuperación automática simplificada, el mantenimiento programado y la retirada. Para actuar en función de las notificaciones de estado, reprograma el evento programado o detén e inicia la instancia manualmente.

Visualización de las comprobaciones de estado

Utiliza la consola de Amazon EC2 o AWS CLI para ver las comprobaciones de estado de la instancia. Si la instancia no pasó una comprobación de estado, consulta ¿Cómo soluciono los errores de verificación de estado de mi instancia de EC2 de Linux?

Visualización de los registros del sistema

Si la instancia no supera la comprobación de estado, es posible que se reinicie debido a problemas con el sistema operativo. Para solucionar problemas a nivel del sistema operativo, consulta los registros del sistema /var/log/messages y /var/log/syslog. Si la instancia no ha superado la comprobación de estado, reiníciala para recuperar los registros del sistema.

A continuación, solucione el error que aparece en el registro del sistema.

Visualización del historial de reinicios

Para comprobar si un usuario o una aplicación del servidor ha provocado el reinicio, ejecuta el siguiente comando:

grep reboot /home/*/.bash_history
grep reboot /root/.bash_history
history | grep -i reboot
history | grep -i init
last reboot

Consulta del historial de eventos de CloudTrail

Los reinicios de instancias que iniciaste en la consola de Amazon EC2 o en AWS CLI aparecen en el historial de eventos de AWS CloudTrail. Consulta el historial de eventos de CloudTrail para ver los eventos de RebootInstances.

Nota: Al crear una AMI, Amazon EC2 activa la instancia de reinicio de forma predeterminada y reinicia la instancia antes de crear la AMI. Este reinicio aparece en el evento CreateImage, no en el evento RebootInstances.

Si has creado una política de ciclo de vida de AMI, comprueba en Reinicio de instancia si has establecido Reiniciar instancia al ejecutar la política como . Si es así, quiere decir que la instancia se reinició durante la creación de la AMI.

Para recuperar automáticamente las instancias que se reinician debido a problemas de hardware, configura la recuperación basada en acciones de Amazon CloudWatch.

Actualización del kernel

Nota: Se recomienda crear una copia de seguridad de AMI de la instancia antes de actualizar los paquetes que contiene. Esta configuración te permite revertir los cambios, si es necesario.

Para actualizar el kernel, sigue estos pasos:

  1. Para comprobar la versión del kernel que usa la instancia, ejecuta el siguiente comando:

    sudo uname -r
  2. Para actualizar el kernel, ejecuta uno de los siguientes comandos según tu sistema operativo Linux.
    Red Hat Enterprise Linux (RHEL) o Amazon Linux:

    sudo yum update kernel

    SUSE Linux Enterprise Server (SLES):

    sudo zypper up kernel-default

    Ubuntu:

    sudo apt upgrade linux-image-aws
  3. Para reiniciar la instancia y usar el nuevo kernel, ejecuta el siguiente comando:

    sudo reboot

Consulta del historial de comandos de ejecución para comprobar si Systems Manager ha reiniciado la instancia

Si configuras una operación de aplicación de parches en tu instancia con RebootOption establecida en RebootIfNeeded, Systems Manager reinicia la instancia durante la aplicación de un parche.

Para comprobar si Systems Manager ejecutó un comando Run, sigue estos pasos:

  1. Abre la consola de Systems Manager.
  2. En el panel de navegación, selecciona Ejecutar comando.
  3. Selecciona la pestaña Historial de comandos.
  4. En el cuadro de búsqueda, escribe tu ID de instancia para ver todos los comandos que Systems Manager ejecutó para la instancia.

Información relacionada

Solución de problemas de las instancias de Amazon EC2 para Linux con comprobaciones de estado no superadas

Tipos de comprobaciones de estado

Administración de las notificaciones de AWS Health en AWS User Notifications

¿Cómo vuelvo a un kernel estable conocido después de que una actualización bloquee el reinicio de mi instancia de EC2?

OFICIAL DE AWSActualizada hace 10 meses