Nota
O acesso a esta página requer autorização. Pode tentar iniciar sessão ou alterar os diretórios.
O acesso a esta página requer autorização. Pode tentar alterar os diretórios.
O Azure Chaos Studio é um serviço gerido que o ajuda a validar a resiliência das suas aplicações Azure ao injetar interrupções controladas, como desligar máquinas virtuais, forçar failovers de bases de dados e bloquear a resolução DNS. Pode usar o Chaos Studio para reproduzir padrões reais de interrupções, verificar se os seus mecanismos de recuperação funcionam e construir provas de que os seus sistemas lidam com falhas de forma elegante.
Espaços de Trabalho e Cenários
A forma mais rápida de começar é com um Workspace. Um Workspace liga-se ao seu ambiente Azure através de um âmbito (uma subscrição, grupo de recursos ou grupo de serviços), descobre os recursos que implementou e recomenda cenários que simulam padrões reais de interrupção contra esses recursos.
Os espaços de trabalho são flexíveis. Pode organizá-los para se adaptarem à sua equipa: criar um Workspace por aplicação, um por ambiente (pré-produção vs. produção), um por equipa ou um por limite de conformidade. O escopo determina que recursos o Workspace vê, por isso controlas o raio de explosão ao nível do Workspace.
Cada cenário é um teste de resiliência pré-configurado. Em vez de montar Ações individuais manualmente, seleciona um Cenário como Compute Zone Down ou DNS Outage, e o Chaos Studio trata da composição das Ações, descoberta de recursos e sequenciação. Depois da execução, recebes um relatório de Cenário, um registo estruturado do que aconteceu que podes usar para cumprimento, retrospectivas ou comunicação com as partes interessadas.
Os cenários disponíveis abrangem falhas de zona e de rede, failovers na base de dados, estampidas de cache e interrupções de mensagens. Quando os modelos incorporados não se adequarem às suas necessidades, use o designer de Cenários para adaptar um modelo ao seu próprio Cenário guardado. Consulte Cenários no Azure Chaos Studio para consultar o catálogo completo.
Para criar o seu primeiro Espaço de Trabalho e executar um Cenário, veja Início Rápido: Criar um Espaço de Trabalho e executar o seu primeiro Cenário.
Experiências (clássicas)
Para composições de falhas personalizadas que não estão abrangidas pelo catálogo Scenario, crie experimentos diretamente. As experimentações dão-lhe controlo total sobre passos, ramificações, ações, destinos e seletores. Este modelo é o modelo original do Chaos Studio, e as experiências existentes continuam a funcionar como antes.
O Chaos Studio suporta dois tipos de falhas:
- Service-direct: Falhas que correm diretamente contra um recurso do Azure através da sua API de gestão, sem necessidade de agente. Exemplos incluem desligar uma máquina virtual, acionar um failover de base de dados SQL ou esvaziar uma cache Redis.
- Baseado em agente: Falhas que são executadas dentro de uma máquina virtual ou de um conjunto de dimensionamento de máquinas virtuais para injetar falhas no sistema convidado, como pressão da CPU, pressão de memória ou terminação de processos.
Cada falha tem parâmetros específicos que podes configurar. Quando constróis um experimento, defines um ou mais passos que se executam sequencialmente. Cada passo contém um ou mais ramos que correm em paralelo. Cada ramificação contém uma ou mais ações, como injetar uma falha ou aguardar durante um período especificado.
Para obter uma explicação passo a passo do modelo de experimento, consulte Experimentos de Caos no Azure Chaos Studio.
Plugin de IA do Chaos Studio
O plugin de IA do Chaos Studio (startchaos) permite-lhe criar espaços de trabalho, configurar cenários, executá-los e analisar os resultados através de uma interface conversacional. O plugin funciona tanto como uma capacidade interativa na CLI do GitHub Copilot como um servidor MCP (Model Context Protocol) ao qual os agentes autónomos podem recorrer.
Após a conclusão de uma execução de cenário, a ferramenta de análise de impacto do plugin correlaciona métricas, registos e eventos do registo de atividade do Azure Monitor com os recursos alvo, para que possa ver quais os sinais movidos durante o teste sem construir dashboards manualmente.
Para instruções de configuração e a referência completa da ferramenta, consulte o repositório de plugins do Chaos Studio.
Quando usar o Chaos Studio
O Chaos Studio encaixa-se em vários pontos do seu ciclo de vida de desenvolvimento e operações:
- Reprodução de incidentes: Após uma falha, reproduza o padrão de falhas para verificar se as suas correções melhoram a resiliência.
- Dias de jogo: Antes de um evento importante, execute cenários no seu ambiente de produção ou pré-produção para validar que os seus sistemas lidam com os modos de falha esperados.
- Testes de continuidade de negócios: Validar o comportamento de failover e os objetivos de tempo de recuperação para planos de recuperação de desastres.
- Validação contínua: Execute cenários ou experiências como portas de implementação nos seus pipelines CI/CD para detetar regressões de resiliência antes que cheguem à produção.
- Evidência de conformidade: Use relatórios de cenários para ajudar a apoiar os requisitos de evidência para quadros de resiliência operacional, como o DORA.
O vídeo a seguir fornece mais informações sobre o Chaos Studio:
Comunicar problemas e solicitar funcionalidades
Azure Chaos Studio é desenvolvido ao ar livre. Para reportar um bug, pedir uma funcionalidade ou colocar uma questão sobre Workspaces, Cenários ou a extensão CLI do Azure, abra uma questão no repositório Chaos Studio no GitHub. Ao apresentar uma reclamação, pode acompanhar o seu progresso e ver pedidos de outros clientes.