Key Takeaways
Descubre qué es un kill switch, cómo funciona este mecanismo y por qué es una capa importante de seguridad y gobernanza para los agentes de inteligencia artificial.
A medida que los agentes de inteligencia artificial comienzan a ejecutar tareas complejas, acceder a sistemas, activar herramientas e interactuar con clientes de forma cada vez más autónoma, la conversación sobre seguridad también adquiere una nueva dimensión.
No basta con definir qué puede hacer un agente cuando todo funciona según lo esperado. Las empresas también necesitan establecer cómo actuar cuando ocurre un comportamiento inesperado, como una secuencia repetitiva de llamadas que puede consumir recursos rápidamente, una instrucción maliciosa que intenta desviar al agente de sus directrices o una integración que empieza a ejecutar acciones fuera del flujo previsto.
Para ayudar en este proceso, se creó el Kill Switch. Este mecanismo permite interrumpir rápidamente la actividad de un agente, limitando los efectos de un incidente sin necesidad de desactivar toda la infraestructura ni detener otros agentes que siguen funcionando con normalidad.
En este artículo, vamos a entender qué es un kill switch, cómo funciona y qué beneficios ofrece para los agentes de IA.
También te puede interesar: 5 formas de crear agentes de IA confiables
Lo que veremos a continuación:
¿Qué es un Kill Switch?
Un kill switch es un mecanismo de seguridad diseñado para interrumpir rápidamente el funcionamiento de un sistema, proceso o agente cuando se identifica un comportamiento inesperado, inadecuado o potencialmente riesgoso.
En entornos de inteligencia artificial, funciona como una capa adicional de control para limitar la actividad de agentes autónomos durante un incidente.
En la práctica, este recurso permite que los equipos responsables de la operación interrumpan la actividad de un agente sin necesidad de desactivar toda la infraestructura en la que se está ejecutando.
Esto es especialmente importante en arquitecturas con varios agentes funcionando al mismo tiempo, ya que un problema aislado no tiene por qué provocar la indisponibilidad de los demás.
Imagina, por ejemplo, que un agente de IA entra en un ciclo continuo de llamadas a herramientas y comienza a consumir recursos de manera excesiva. En lugar de esperar a que el propio sistema resuelva el problema o detener todos los agentes en producción, el kill switch permite contener específicamente el componente afectado.
En resumen, el kill switch forma parte de una estrategia de gobernanza y seguridad para agentes de IA, ya que ofrece a las organizaciones una forma de intervenir rápidamente cuando sea necesario y mantiene la supervisión humana sobre sistemas que operan con niveles cada vez mayores de autonomía.
En Salesforce, el Agent Kill Switch, disponible en Agent Fabric a través de Omni Gateway, fue desarrollado precisamente para ofrecer este tipo de control. Además de interrumpir el tráfico del agente, el mecanismo permite bloquear su comunicación con otros componentes de la red y mantener registros de las acciones realizadas.
Tipos de Kill Switch
Como el kill switch es un mecanismo de seguridad creado para interrumpir rápidamente el funcionamiento de un sistema, puede aplicarse a diferentes tecnologías bajo el mismo principio: ofrecer una forma rápida de detener una operación cuando sea necesario. Este recurso puede estar presente en distintos contextos, como:
- VPNs: pueden interrumpir la conexión a internet cuando la VPN se desconecta, ayudando a evitar la transmisión de datos sin la protección esperada.
- Vehículos: pueden utilizar mecanismos de apagado en situaciones de emergencia para interrumpir determinados sistemas y contribuir a la seguridad.
- Dispositivos electrónicos: pueden contar con funciones de apagado para detener el funcionamiento del equipo o de componentes específicos ante fallas o situaciones inesperadas.
- Software y aplicaciones: pueden incorporar mecanismos para desactivar rápidamente una función o servicio en caso de fallas, vulnerabilidades o comportamientos inesperados.
- Sistemas industriales: pueden detener máquinas o procesos en situaciones de emergencia, ayudando a reducir riesgos para las personas y los equipos.
En todos estos casos, el kill switch funciona como una capa adicional de control, permitiendo una respuesta rápida ante situaciones que requieren interrumpir una operación.
Crea agentes de IA
confiables y eficientes
Descubre cómo combinar la
creatividad de los LLM con reglas de negocio para crear agentes más predecibles y seguros.
¿Cómo funciona el Kill Switch?
El funcionamiento de un kill switch parte de un principio sencillo: interrumpir la actividad de un agente en el nivel adecuado para cada incidente, evitando que un problema localizado afecte a toda la operación.
Un kill switch puede actuar en diferentes niveles:
- Solicitud: interrumpe una ejecución específica que presenta un comportamiento inesperado;
- Sesión: bloquea la continuidad de una interacción o conversación determinada;
- Instancia del agente: contiene a un agente cuyo comportamiento indica un problema más amplio;
- Entorno: en situaciones críticas, permite interrumpir una operación de manera más general.
De esta forma, la respuesta puede ser proporcional al riesgo identificado.
En Agent Kill Switch de Salesforce, la contención ocurre en el nivel de Model Proxy. Cuando una instancia se pone en cuarentena, el tráfico relacionado con ella deja de ser dirigido por los proxies del sistema, lo que impide que el agente continúe accediendo a modelos o comunicándose con otros agentes de la red.
Este bloqueo reduce la posibilidad de que rutas alternativas, nuevos intentos automáticos o instrucciones almacenadas permitan que la actividad continúe después de la intervención. En situaciones en las que esperar representa un riesgo mayor, un hard stop puede interrumpir el tráfico de inmediato.
Otro elemento importante es la reversibilidad. Una vez que el equipo analiza el incidente y considera seguro reanudar la operación, el agente puede restaurarse al estado en el que se encontraba antes de la interrupción. Esto permite actuar rápidamente ante señales de riesgo sin convertir cada intervención preventiva en un proceso complejo de recuperación.
Además, cada acción de interrupción genera un registro con información como quién realizó la intervención, cuándo ocurrió, cuál fue el alcance aplicado y qué componentes se vieron afectados. Esta trazabilidad contribuye tanto al análisis posterior de incidentes como a las prácticas de gobernanza, auditoría y cumplimiento normativo.
¿Cuáles son los beneficios del Kill Switch?
A medida que los agentes de IA asumen tareas más complejas y comienzan a interactuar con diferentes sistemas, la capacidad de interrumpir rápidamente una acción inadecuada se vuelve una parte relevante de la estrategia de seguridad.
El kill switch es un mecanismo importante que ofrece diversas ventajas para la operación, entre ellas:
- Contención proporcional al incidente: no todos los problemas requieren desactivar toda la infraestructura. Uno de los principales beneficios del kill switch es permitir que la empresa limite la intervención al componente afectado y preserve el funcionamiento de los demás agentes que continúan operando con normalidad.
- Respuesta más rápida ante comportamientos inesperados: en incidentes relacionados con agentes de IA, algunos segundos pueden marcar la diferencia. Con un kill switch, los equipos pueden interrumpir rápidamente ese comportamiento e iniciar el análisis con el agente ya contenido. Esto reduce el tiempo entre la identificación del problema y la aplicación de una medida de protección.
- Recuperación más sencilla: otro beneficio importante es la posibilidad de restaurar el agente una vez que el incidente haya sido analizado y considerado resuelto, reduciendo el impacto de las intervenciones preventivas.
- Mayor trazabilidad y gobernanza: interrumpir un agente es solo una parte del proceso. En entornos empresariales, también es necesario saber quién realizó la acción, cuándo ocurrió, cuál fue su alcance y qué componentes se vieron afectados. El registro de esta información ayuda a los equipos de seguridad, tecnología y cumplimiento a reconstruir incidentes, identificar causas y revisar las políticas de operación. Esta trazabilidad también crea una base más consistente para auditorías y para la evolución de los controles aplicados a los agentes.
- Mayor seguridad para llevar agentes a producción: al combinar contención, reversibilidad y trazabilidad, el kill switch ayuda a establecer límites operativos claros para los agentes. Esto crea condiciones para que los equipos avancen con proyectos de IA sabiendo que existen mecanismos definidos para interrumpir, investigar y restaurar la operación cuando sea necesario.
¿Cómo utilizar el Kill Switch?
Descubre cómo utilizar este recurso de forma eficiente y segura.
1 – Define previamente los criterios de interrupción
Los equipos de seguridad, tecnología y negocio deben establecer qué señales pueden justificar la activación del recurso.
Entre ellas pueden estar comportamientos fuera de las instrucciones definidas, ciclos repetitivos de llamadas, consumo anormal de recursos, intentos de inyección de prompts o acciones incompatibles con las políticas de la organización.
También es importante determinar quién puede autorizar cada nivel de interrupción y en qué situaciones una decisión debe escalarse a otros equipos.
2 – Elige el alcance adecuado
Una vez identificado el incidente, la intervención debe ser proporcional al problema. Aplicar el menor alcance necesario ayuda a reducir los impactos sobre otros flujos y agentes que continúan funcionando con normalidad.
Por ello, el equipo debe evaluar si el incidente está limitado a una solicitud, sesión o instancia específica, o si requiere una contención más amplia.
3 – Interrumpe e investiga el comportamiento
Con el agente contenido, la organización puede analizar logs, llamadas realizadas, instrucciones recibidas y demás información relacionada con el incidente sin que continúen ejecutándose nuevas acciones.
Este periodo es importante para identificar el origen del problema, verificar su alcance y determinar si es necesario realizar cambios en prompts, permisos, integraciones, políticas o configuraciones del agente.
4 – Valida antes de restaurar
Una vez comprendida la causa del comportamiento y realizadas las correcciones necesarias, el siguiente paso es validar si el agente puede volver a operar de forma segura.
En Agent Kill Switch de Salesforce, la funcionalidad Restore permite reanudar la operación después de la interrupción. La restauración debe realizarse únicamente cuando los equipos responsables hayan verificado que las condiciones que motivaron el bloqueo fueron resueltas.
5 – Prueba el proceso antes de un incidente real
Un procedimiento de emergencia es más confiable cuando ya ha sido probado. Por ello, una buena práctica es realizar simulaciones de interrupción y restauración en entornos que no sean de producción.
Estas pruebas ayudan a confirmar que los equipos conocen sus responsabilidades, que los criterios de activación están claros y que los flujos de contención y recuperación funcionan según lo esperado.
Preguntas frecuentes sobre Kill Switch
¿Qué es un kill switch en agentes de IA?
Un kill switch es un mecanismo de seguridad que permite interrumpir rápidamente la actividad de un agente de IA cuando presenta un comportamiento inesperado, inadecuado o potencialmente riesgoso. El objetivo es contener el problema antes de que afecte a otros sistemas, usuarios o procesos.
¿Para qué sirve un kill switch?
El kill switch sirve para limitar los impactos de incidentes relacionados con agentes de IA. Puede utilizarse, por ejemplo, cuando un agente entra en ciclos repetitivos, ejecuta acciones fuera de lo esperado, consume recursos de manera anormal o sufre interferencias como intentos de inyección de prompts.
¿El kill switch desactiva todos los agentes de IA?
No necesariamente. Uno de los principales beneficios del recurso es permitir una contención proporcional al incidente. Dependiendo de la arquitectura utilizada, la interrupción puede aplicarse a una solicitud, sesión, instancia específica del agente o a un entorno más amplio.
¿Cuál es la diferencia entre un hard stop y una interrupción localizada?
Una interrupción localizada busca contener únicamente el flujo o agente afectado, preservando el resto de la operación. En cambio, el hard stop se utiliza cuando es necesario interrumpir inmediatamente el tráfico del agente, especialmente en situaciones en las que continuar operando representa un riesgo mayor.
¿Un agente puede volver a funcionar después de activar el kill switch?
Sí. Cuando el mecanismo ofrece capacidad de restauración, el agente puede volver a operar después de que el incidente haya sido investigado, se hayan realizado las correcciones necesarias y los equipos responsables hayan determinado que es seguro reanudar la actividad.
En Agent Kill Switch de Salesforce, la función Restore permite restaurar el agente después de la contención.
¿Qué te ha parecido aprender más sobre Kill Switch?
Nuestro blog siempre está actualizado con novedades sobre CRM y tecnología. Otros artículos útiles:
- Tecnologías emergentes: cómo los agentes inteligentes están redefiniendo el auto atendimiento
- Automatización industrial: qué es, beneficios, y impactos | Salesforce
- RPA: Qué es y cómo optimizar la automatización de operaciones | Salesforce
- Redes neuronales: el fundamento de la IA que está redefiniendo cómo operan las empresas
Descubre todas las funcionalidades de Salesforce y cómo nuestro CRM de IA transforma tu empresa.
Guía para gestionar una compañía agéntica
Descubre cómo definir funciones, establecer métricas y gestionar agentes de IA de forma segura a lo largo de todo su ciclo de vida.


