Skip to Content

Kill Switch: o que é e como ele aumenta o controle sobre agentes de IA

Entenda o que é kill switch, como funciona e por que esse recurso reforça a segurança e a governança de agentes de IA.

Key Takeaways

This summary was created with AI and reviewed by an editor.

Entenda o que é kill switch, como esse mecanismo funciona e por que é uma camada importante de segurança e governança para agentes de inteligência artificial.

À medida que agentes de inteligência artificial passam a executar tarefas complexas, acessar sistemas, acionar ferramentas e interagir com clientes de forma cada vez mais autônoma, a discussão sobre segurança também ganha uma nova dimensão.

Não basta definir o que um agente pode fazer quando tudo funciona como esperado. As empresas também precisam estabelecer como agir quando um comportamento inesperado acontece, como uma sequência repetitiva de chamadas que pode consumir recursos rapidamente, uma instrução maliciosa que pode tentar desviar o agente de suas diretrizes ou uma integração que pode começar a executar ações fora do fluxo previsto.

Para ajudar nesse processo, o Kill Switch foi criado. O mecanismo funciona como uma forma de interromper rapidamente a atuação de um agente, limitando os efeitos de um incidente sem necessariamente desligar toda a infraestrutura ou interromper outros agentes que continuam funcionando normalmente.

Neste artigo, vamos entender o que é um kill switch, como ele funciona e quais benefícios ele oferece para ambientes com agentes de IA.

Veja também: 5 Maneiras de Construir Agentes de IA Confiáveis 

O que é um Kill Switch?

Um kill switch é um mecanismo de segurança criado para interromper rapidamente o funcionamento de um sistema, processo ou agente quando é identificado um comportamento inesperado, inadequado ou potencialmente arriscado. 

Em ambientes de inteligência artificial, ele funciona como uma camada adicional de controle para limitar a atuação de agentes autônomos durante uma ocorrência.

Na prática, o recurso permite que equipes responsáveis pela operação interrompam a atividade de um agente sem necessariamente desligar toda a infraestrutura em que ele está executando. 

Isso é especialmente importante em arquiteturas com diversos agentes funcionando simultaneamente, já que um problema isolado não precisa provocar a indisponibilidade dos demais.

Imagine, por exemplo, que um agente de IA entre em um ciclo contínuo de chamadas a ferramentas, passe a consumir recursos de forma excessiva ou tenha suas instruções afetadas por uma tentativa de prompt injection. Em vez de esperar que o problema seja resolvido pelo próprio sistema ou interromper todos os agentes em produção, o kill switch permite conter especificamente o componente afetado.

Em resumo, o  kill switch faz parte de uma estratégia de governança e segurança para agentes de IA, oferecendo às organizações uma forma de intervir rapidamente quando necessário, e mantendo a supervisão humana sobre sistemas que operam com níveis cada vez maiores de autonomia.

Na Salesforce, o Agent Kill Switch, disponível no Agent Fabric por meio do Omni Gateway, foi desenvolvido justamente para oferecer esse tipo de controle. Além de interromper o tráfego do agente, o mecanismo permite bloquear sua comunicação com outros componentes da rede e manter registros das ações realizadas.

Tipos de Kill Switch

Como o kill switch é um mecanismo de segurança criado para interromper rapidamente o funcionamento de um sistema, ele pode ser aplicado a diferentes tecnologias com o mesmo princípio: oferecer uma forma rápida de interromper uma operação quando necessário. Esse recurso pode estar presente em diferentes contextos, como:

  • VPNs: podem interromper a conexão com a internet quando a VPN é desconectada, ajudando a evitar a transmissão de dados sem a proteção esperada.
  • Veículos: podem utilizar mecanismos de desligamento em situações de emergência para interromper determinados sistemas e contribuir para a segurança.
  • Dispositivos eletrônicos: podem contar com recursos de desligamento para interromper o funcionamento do equipamento ou de componentes específicos diante de falhas ou situações inesperadas.
  • Software e aplicativos: mecanismos que desativam rapidamente uma função ou serviço em caso de falhas, vulnerabilidades ou comportamentos inesperados.
  • Sistemas industriais: podem interromper máquinas ou processos em situações de emergência, ajudando a reduzir riscos para pessoas e equipamentos.

Em todos esses casos, o kill switch funciona como uma camada adicional de controle, permitindo uma resposta rápida diante de situações que exigem a interrupção de uma operação.

Crie agentes de IA confiáveis e que funcionam

Descubra como combinar a criatividade dos LLMs com regras de negócio para criar agentes mais previsíveis e seguros.

Como o Kill Switch funciona?

O funcionamento de um kill switch parte de um princípio simples: interromper a atuação de um agente no nível adequado ao incidente, evitando que um problema localizado afete toda a operação.

Um kill switch pode atuar em diferentes níveis:

  • Solicitação: interrompe uma execução específica que apresenta comportamento inesperado;
  • Sessão: bloqueia a continuidade de uma determinada interação ou conversa;
  • Instância do agente: contém um agente cujo comportamento indica um problema mais amplo;
  • Ambiente: em situações críticas, permite interromper uma operação de forma mais abrangente.

Dessa forma, a resposta pode ser proporcional ao risco identificado.

No Agent Kill Switch da Salesforce, a contenção acontece no nível do Model Proxy. Quando uma instância é colocada em quarentena, o tráfego relacionado a ela deixa de ser encaminhado pelos proxies do sistema, impedindo que o agente continue acessando modelos ou se comunicando com outros agentes da rede.

Esse bloqueio reduz a possibilidade de que caminhos alternativos, novas tentativas automáticas ou instruções já armazenadas permitam que a atividade continue depois da intervenção. Em situações nas quais esperar representa um risco maior, um hard stop pode interromper o tráfego imediatamente.

Outro elemento importante é a reversibilidade. Depois que a equipe analisa o incidente e considera seguro retomar a operação, o agente pode ser restaurado ao estado em que estava antes da interrupção. Isso permite agir rapidamente diante de sinais de risco sem transformar toda intervenção preventiva em um processo complexo de recuperação.

Além disso, cada ação de interrupção gera um registro com informações como quem realizou a intervenção, quando ela ocorreu, qual foi o escopo aplicado e quais componentes foram afetados. Essa rastreabilidade contribui tanto para análises posteriores de incidentes quanto para práticas de governança, auditoria e compliance.

Quais são os benefícios do Kill Switch?

À medida que agentes de IA assumem tarefas mais complexas e passam a interagir com diferentes sistemas, a capacidade de interromper rapidamente uma ação inadequada torna-se parte relevante da estratégia de segurança. 

O kill switch é um mecanismo importante que proporciona diversas vantagens para a operação, como:.

  • Contenção proporcional ao incidente: nem todo problema exige desligar toda a infraestrutura. Um dos principais benefícios do kill switch é permitir que a empresa limite a intervenção ao componente afetado, preservando o funcionamento dos demais agentes que continuam operando normalmente.
  • Resposta mais rápida a comportamentos inesperados: em incidentes envolvendo agentes de IA, alguns segundos podem fazer diferença. Com um kill switch, as equipes conseguem interromper rapidamente esse comportamento e iniciar a análise com o agente já contido. Isso reduz o tempo entre a identificação do problema e a aplicação de uma medida de proteção.
  • Recuperação mais simples: outro benefício importante é a possibilidade de restaurar o agente depois que o incidente foi analisado e considerado resolvido, reduzindo o impacto de intervenções preventivas.
  • Mais rastreabilidade e governança: interromper um agente é apenas parte do processo. Em ambientes empresariais, também é necessário saber quem realizou a ação, quando ela ocorreu, qual foi seu escopo e quais componentes foram afetados. O registro dessas informações ajuda equipes de segurança, tecnologia e compliance a reconstruir incidentes, identificar causas e revisar políticas de operação. Essa rastreabilidade também cria uma base mais consistente para auditorias e para a evolução dos controles aplicados aos agentes.
  • Mais segurança para colocar agentes em produção: ao combinar contenção, reversibilidade e rastreabilidade, o kill switch ajuda a estabelecer limites operacionais claros para os agentes. Isso cria condições para que equipes avancem com projetos de IA sabendo que existem mecanismos definidos para interromper, investigar e restaurar a operação quando necessário.

Leia também: Observabilidade Agêntica: A Chave para Levar Agentes de IA à Produção com Segurança. 

Como utilizar o Kill Switch?

Descubra como utilizar o recurso de forma eficiente e segura

1 – Defina previamente os critérios de interrupção

As equipes de segurança, tecnologia e negócio devem estabelecer quais sinais podem justificar a ativação do recurso. 

Entre eles podem estar comportamentos fora das instruções definidas, ciclos repetitivos de chamadas, consumo anormal de recursos, tentativas de prompt injection ou ações incompatíveis com as políticas da organização.

Também é importante determinar quem pode autorizar cada nível de interrupção e em quais situações uma decisão precisa ser escalada para outras equipes.

2 – Escolha o escopo adequado

Depois de identificado o incidente, a intervenção deve ser proporcional ao problema. Aplicar o menor escopo necessário ajuda a reduzir impactos sobre outros fluxos e agentes que continuam funcionando normalmente.

Por isso, a equipe deve avaliar se a ocorrência está restrita a uma solicitação, sessão ou instância específica ou se exige uma contenção mais ampla.

3 – Interrompa e investigue o comportamento

Com o agente contido, a organização pode analisar logs, chamadas realizadas, instruções recebidas e demais informações relacionadas ao incidente sem que novas ações continuem sendo executadas.

Esse período é importante para identificar a origem do problema, verificar seu alcance e determinar se são necessárias mudanças em prompts, permissões, integrações, políticas ou configurações do agente.

4 – Valide antes de restaurar

Depois que a causa do comportamento é compreendida e as correções necessárias são realizadas, o próximo passo é validar se o agente pode voltar a operar com segurança.

No Agent Kill Switch da Salesforce, a funcionalidade de Restore permite retomar a operação após a interrupção. A restauração deve acontecer apenas depois que as equipes responsáveis verificarem que as condições que motivaram o bloqueio foram resolvidas.

5 – Teste o processo antes de um incidente real

Um procedimento de emergência é mais confiável quando já foi testado. Por isso, uma boa prática é executar simulações de interrupção e restauração em ambientes que não sejam de produção.

Esses testes ajudam a confirmar se as equipes conhecem suas responsabilidades, se os critérios de acionamento estão claros e se os fluxos de contenção e recuperação funcionam como esperado.

Perguntas frequentes sobre Kill Switch

O que é um kill switch em agentes de IA?

Um kill switch é um mecanismo de segurança que permite interromper rapidamente a atuação de um agente de IA quando ele apresenta comportamento inesperado, inadequado ou potencialmente arriscado. O objetivo é conter o problema antes que ele afete outros sistemas, usuários ou processos.

Para que serve um kill switch?

O kill switch serve para limitar os impactos de incidentes envolvendo agentes de IA. Ele pode ser utilizado, por exemplo, quando um agente entra em ciclos repetitivos, executa ações fora do esperado, consome recursos de forma anormal ou sofre interferências como tentativas de prompt injection.

O kill switch desliga todos os agentes de IA?

Não necessariamente. Um dos principais benefícios do recurso é permitir uma contenção proporcional ao incidente. Dependendo da arquitetura utilizada, a interrupção pode ser aplicada a uma solicitação, sessão, instância específica de agente ou a um ambiente mais amplo.

Qual é a diferença entre hard stop e uma interrupção localizada?

Uma interrupção localizada procura conter apenas o fluxo ou agente afetado, preservando o restante da operação. Já o hard stop é utilizado quando é necessário interromper imediatamente o tráfego do agente, especialmente em situações nas quais continuar operando representa um risco maior.

Um agente pode voltar a funcionar depois que o kill switch é acionado?

Sim. Quando o mecanismo oferece capacidade de restauração, o agente pode voltar a operar depois que o incidente foi investigado, as correções necessárias foram realizadas e as equipes responsáveis determinaram que a retomada é segura.

No Agent Kill Switch da Salesforce, a função de Restore permite restaurar o agente após a contenção.

O que você achou de saber mais sobre Kill Switch? 

O nosso blog está sempre atualizado com novidades e conteúdos sobre vendas e inteligência artificial. A seguir, sugerimos algumas outras leituras que podem ser úteis:

Guia para operar uma empresa agêntica

Descubra como definir funções, estabelecer métricas e gerenciar agentes de IA com segurança ao longo de todo o ciclo de vida.