我想了解是什么原因导致 Amazon Redshift 更换了节点以及更换节点对集群有何影响。
简短描述
Amazon Redshift 集群节点更换是因硬件故障或硬件性能问题而进行的维护操作。节点更换可能会暂时中断数据库连接并影响操作。Amazon Redshift 通过更换节点来确保您的数据仓库集群保持健康、可靠且性能良好。
解决方法
硬件故障
硬件故障、硬件性能问题或潜在的故障风险都可能导致 Amazon Redshift 更换节点。Amazon Redshift 会持续监控每个集群节点内的硬件组件。当 Amazon Redshift 检测到其中一个组件存在问题时,它会更换该节点。
节点更换为预防性措施,用于避免硬件组件出现故障时可能发生的数据损坏。但是,当集群在节点更换后在节点之间重新分配数据时,您可能会遇到暂时的性能问题。
计划维护
为了提高集群的可靠性和性能,Amazon Redshift 会在默认维护时段内执行系统更新、应用补丁以及更换硬件组件。
对集群操作的影响
当 Amazon Redshift 更换节点时,您可能会遇到暂时的集群节点中断,这会影响性能。对于单节点集群,如果集群状态为硬件故障,则无法更换节点。相反,必须从快照中恢复该节点。有关详细信息,请参阅 Amazon Redshift 快照和备份。
节点更换最佳实践
为了最大限度地减少节点更换对数据库操作的影响,请使用以下最佳实践:
- 查看 Amazon Redshift 事件通知,这些通知会提醒您可能导致节点更换的维护时段或硬件问题,并相应地计划您的操作。
- 您可以推迟集群的维护时段,以便在非高峰时段或数据库活动较少的时间段进行维护。
- 在您的应用程序中构建重试机制。重试机制可以处理节点更换期间的临时连接丢失或性能低下的问题,以便您的应用程序可以在节点更换完成后恢复并正常运行。所有 AWS SDK 都有内置重试机制,其算法使用指数回退功能。
- 对于生产工作负载,请使用多节点集群,因为多节点集群比单节点集群提供更好的容错能力和可用性。
相关信息
Amazon Redshift 中的集群和节点
Amazon Redshift 预置集群事件通知
使用 Amazon Redshift 预置集群时的注意事项