
Chaos Engineering: por qué todo administrador de sistemas debería romper su infraestructura (antes que los usuarios)
Durante años, la alta disponibilidad se resumía en comprar mejores servidores, montar un clúster, añadir redundancia y confiar en que todo siguiera funcionando cuando llegara el siguiente fallo. Netflix demostró que esa estrategia ya no era suficiente. Hace unos 15 años empezó a apagar servidores de producción de forma completamente aleatoria. No porque estuvieran averiados, sino para comprobar si realmente



