Ir para o conteúdo

Como soluciono o erro “503 Service Unavailable” no Amazon Bedrock?

3 minuto de leitura
0

Quero solucionar o erro “503 Service Unavailable” que recebo quando uso os recursos sob demanda do Amazon Bedrock. Eu não excedi as cotas da conta da AWS.

Resolução

Observação: se você receber erros ao executar comandos da AWS Command Line Interface (AWS CLI), consulte Solução de problemas da AWS CLI. Além disso, verifique se você está usando a versão mais recente da AWS CLI.

Você recebe a mensagem de erro 503 Service Unavailable para exceções do lado do servidor que ocorrem quando o servidor não consegue responder devido a falhas. Ou o erro ocorre quando um aumento nas solicitações causa uma pressão sobre os recursos compartilhados. Para identificar a causa do erro, execute as seguintes ações.

Verifique o status do serviço

Se você não conseguir acessar o Amazon Bedrock, verifique a disponibilidade do serviço. Verifique a integridade do serviço no AWS Health Dashboard para verificar se há problemas contínuos com o Amazon Bedrock em sua região da AWS.

Tente fazer a solicitação novamente

Para verificar se o erro é resultado de um aumento temporário na demanda da API, use o recuo exponencial para repetir a solicitação. Esse método reduz a carga no servidor e aumenta a probabilidade de uma solicitação bem-sucedida.

Os SDKs da AWS geralmente têm uma lógica de nova tentativa integrada. Configure o comportamento de repetição do seu SDK da AWS com base em seus requisitos.

Use outra região

Para verificar se o aumento da demanda ou as falhas são específicas de uma região, atualize seus recursos para usar outra região. Ao mudar para uma região diferente, conceda acesso de modelo para o Amazon Bedrock nessa região.

Se você usa SDKs da AWS, verifique a compatibilidade regional do seu SDK da AWS. Para atualizar seu SDK da AWS para usar outra região, execute o seguinte comando set AWS CLI:

aws configure set region new-region-name

Observação: Substitua new-region-name pela nova região.

Use a inferência entre regiões para usar automaticamente a capacidade de várias regiões

Use a inferência entre regiões para gerenciar perfeitamente picos de tráfego não planejados. A inferência entre regiões encaminha dinamicamente as solicitações para regiões que têm capacidade. Isso permite que suas workloads de trabalho sejam escaladas de acordo com a demanda.

Use outros modelos de fundação

Se a demanda aumentar ou ocorrerem falhas em um modelo de fundação específico, use outro modelo de fundação.

Observação: os parâmetros necessários são diferentes para cada modelo de fundação. A API Converse funciona com todos os modelos do Amazon Bedrock que suportam mensagens e permite que você escreva código uma vez e o use com modelos diferentes.

Use Throughput Provisionado

Pré-requisitos: verifique se você está em uma região com suporte para throughput provisionado.

Analise os padrões de uso e os requisitos de pico da sua aplicação. Se você precisar fornecer maior throughput, use o throughput provisionado. Para usar a AWS CLI ou o AWS SDK para Python (Boto3) para usar o throughput provisionado, consulte Exemplos de código para throughput provisionado.