LLM Firewall
El perímetro de protección que mantiene a tu agente de AI seguro, alineado con la marca y con costos controlados.
Descripción general
El LLM Firewall es la capa de protección que se sitúa entre tus clientes y tu AI. Filtra mensajes entrantes de riesgo antes de que lleguen a la AI, detecta respuestas inseguras o fuera de marca antes de enviarlas, y limita conversaciones descontroladas antes de que consuman créditos. Está formado por varias configuraciones que encontrarás agrupadas en la página Configuración del agente → General, y viene activado por defecto para cada workspace: puedes ajustar cada parte o dejar los valores seguros predeterminados.
Funciones
Filtra mensajes entrantes de riesgo
Message Filtering y Topic Auto-Responses bloquean spam, abuso, intentos de prompt injection, códigos de un solo uso y ruido fuera de tema antes de que lleguen a la AI, y responden al instante a preguntas frecuentes con tus propias plantillas. Puedes añadir tus propias reglas sobre qué ignorar.
Detecta respuestas inseguras antes de enviarlas
Los guardrails integrados revisan cada respuesta para detectar instrucciones del sistema filtradas, mensajes demasiado largos y promesas que la AI no puede cumplir. Si la AI falla en mitad de una respuesta, una red de seguridad envía una respuesta alternativa y educada en el idioma del cliente en lugar de quedarse en silencio, y no se te cobra por ese intento fallido.
Limita conversaciones descontroladas
Session Limit & Cooldown establece un tope al número de veces que la AI responde en una misma conversación por día. Si un chat entra en bucle —o si otro bot envía mensajes a tu cuenta— se pausa automáticamente y se reanuda más tarde, para que una sola conversación no consuma tus créditos sin que te des cuenta.
Pasa el control a tu equipo cuando haga falta
La AI se pausa en el momento en que responde un compañero y se reanuda por sí sola, o transfiere el caso bajo demanda con una alerta instantánea, para que las personas y la AI nunca se interpongan, y los casos complejos siempre lleguen a un humano.
Consejos
Preguntas frecuentes
¿Te fue útil esta página?