Colección 11
Resiliencia y chaos engineering
Experimentos de falla con blast radius mínimo y gobernanza.
Pilar · empezá acá Intermedio–Avanzado
Resiliencia y Chaos Engineering: probar la degradación sin convertir la prueba en un incidente
Guía pilar de resiliencia y chaos engineering para QA/SDET: vocabulario, invariantes de negocio, método científico del experimento, gobernanza, blast radius y madurez gradual.
Leer el pilar 18 min
Satélites · profundizan el pilar, en orden
- 02
Patrones de resiliencia con trade-offs: timeout, retry, idempotencia, circuit breaker y bulkhead
Guía de patrones de resiliencia para QA/SDET y devs: timeout, retry con backoff/jitter, idempotencia, circuit breaker, bulkhead, rate limiter y fallback, con trade-offs, orden de aplicación y tabla de decisión.
Intermedio–Avanzado 15 min resiliencecircuit-breakerretry - 03
Diseñar un experimento de caos local seguro: una transferencia con dependencia degradada
Tutorial de chaos engineering seguro en local: ficha de experimento, Toxiproxy en Docker Compose, observabilidad, tests deterministas, matriz de fallas, evidencia control/tratamiento, CI/CD y ADR-006 para Nexo Finanzas.
Avanzado 13 min chaos-engineeringfault-injectiontoxiproxy
Código que implementa esta colección
performance-reliability-testing-suite Suite de performance y fiabilidad: k6 (load/stress/spike/soak), inyección controlada de fallos, gates de SLO y trazabilidad métrica → traza → log.
telco-reliability-lab API telco instrumentada de punta a punta: k6, observabilidad completa (OpenTelemetry, Prometheus, Tempo, Loki, Grafana), idempotencia impuesta por la base y CI con gate de SLO.