Respuesta a incidentes

Cómo FormsFort maneja los incidentes.

FormsFort utiliza alertas automatizadas, trazabilidad de solicitudes, registros de auditoría y revisión de dead-letter para detectar incidentes y responder a ellos. Esta página describe las capacidades de detección, el proceso de respuesta y las señales de escalado.

Capacidades de detección

Evaluación de alertas automatizada

El trabajador de alertas evalúa la acumulación de colas, las fallas de entrega, el volumen HTTP no 2xx, los bloqueos de envío, los depósitos de límite de velocidad, los análisis de archivos adjuntos bloqueados, los errores de almacenamiento de carga y las reservas de carga pendientes con respecto a umbrales configurables.

Webhooks de incidentes externos

Las alertas se pueden enrutar a sistemas externos de gestión de incidentes a través de webhooks HTTPS. Se admiten canales separados para gravedades de advertencia, críticas y escalada.

Alertas de error de migración

Cuando una migración de base de datos falla durante la implementación, se envía una alerta crítica de error de migración a los webhooks de incidentes configurados.

Registro de auditoría

Todas las mutaciones sensibles del administrador se registran en el registro de auditoría con el tipo de actor, ID de solicitud, acción, objetivo y metadatos redactados.

Solicitar seguimiento

Cada respuesta API incluye encabezados X-Request-Id, X-Trace-Id y W3C traceparent para correlación entre servicios y agregación de registros.

Revisión de mensajes fallidos

Los trabajos fallidos de correo electrónico, webhook y Google Sheets se muestran a través del endpoint de mensajes fallidos para que el operador los revise sin exponer las payloads de reintento retenidas.

Proceso de respuesta a incidentes

1

Detección

Las alertas automáticas se activan cuando se superan los umbrales. Los operadores monitorean los retrasos en las colas, las tasas de fallas en la entrega, las tasas de errores HTTP y las señales de abuso.

  • El trabajador de alertas evalúa los umbrales configurados
  • El webhook externo recibe payload de alerta
  • El operador revisa /v1/admin/alerts y /v1/admin/dead-letters
2

Triaje

El operador de guardia evalúa el alcance, los formularios afectados y la causa raíz utilizando ID de solicitud, registros de auditoría y registros de entrega.

  • Identifica los formularios y espacios de trabajo afectados utilizando ID de solicitud
  • Verifique el estado de entrega y las clases de error
  • Revise el registro de auditoría para cambios de configuración recientes
  • Determinar si el incidente está relacionado con la seguridad o es operativo
3

Contención

Acciones inmediatas para limitar el impacto, como bloquear IP abusivas, suprimir destinatarios inseguros o deshabilitar integraciones comprometidas.

  • Agregar reglas de abuso para IP, dominios o agentes de usuario maliciosos
  • Suprime los correos electrónicos de destinatarios devueltos o comprometidos
  • Rotar claves de acceso, tokens de API o URL de webhooks comprometidos
  • Deshabilite las integraciones afectadas desde el panel
4

Remediación

Corrija la causa raíz, restaure el servicio y verifique la solución.

  • Implementar la corrección a través del proceso de puerta de lanzamiento estándar
  • Verificar que los endpoints de estado devuelvan 200
  • Ejecute el simulacro de evidencia de lanzamiento si la infraestructura cambió
  • Borrar entradas de supresión o reglas de abuso si se agregan temporalmente
5

Post-incident

Documentar el incidente, actualizar runbooks e implementar medidas preventivas.

  • Registre el cronograma, la causa raíz y el alcance afectado
  • Actualiza los umbrales de alerta si el incidente se detectó tarde
  • Agregue o actualice reglas de abuso para nuevos patrones de ataque
  • Notificar a los clientes afectados si los datos se vieron afectados

Señales de escalada

Estas condiciones indican que se requiere atención inmediata del operador:

  • /health endpoint devuelve no-200
  • La acumulación de colas crece durante más de un intervalo de trabajo
  • Las tasas de fallas en la entrega aumentan por encima de la línea de base normal
  • rate_limited, abuse_ip, abuse_domain, adjunto_scan_failed o picos de fallas de captcha
  • La limpieza de carga deja de caducar las reservas obsoletas
  • La copia de seguridad o restauración de la base de datos falla
  • Se activa una alerta crítica al webhook de escalada

Notificación al cliente

Si un incidente de seguridad afecta los datos del cliente, FormsFort lo notificará usuarios afectados tan pronto como sea razonablemente posible después de contener el incidente. La notificación incluirá la naturaleza del incidente, los datos afectados y las medidas correctivas adoptadas.

Para consultas relacionadas con la seguridad o para informar un incidente sospechoso, comuníquese con [email protected].