La diferencia entre operar diez instancias y cien no es diez veces el esfuerzo, es otra disciplina. Cualquier cosa manual que funcionaba con diez se vuelve lo que te despierta con cien.
Los deploys tienen que ser aburridos
Cada servicio se despliega igual: pull, build, reload, health-check, listo. Sin casos especiales, sin conocimiento tribal. Un deploy que requiere que una persona recuerde un paso es un deploy que va a fallar en el peor momento.
Hacé el fleet observable
Health checks, logs y métricas no son extras opcionales; son cómo sabés que el fleet está bien sin mirarlo. El objetivo es que un problema se anuncie solo, antes que un cliente.
La recuperación es rutina, no heroísmo
La configuración vive en control de versiones y variables de entorno, nunca hardcodeada. Cualquier instancia se reconstruye de cero, así que una máquina muerta es una molestia, no un incidente. Los secretos quedan fuera de logs y bundles, por política y por tooling.
Sobre AWS — EC2, RDS, S3, CloudFront, ALB, WAF, con Nginx y PM2 — así Develone mantiene 100+ instancias sanas en producción: no trabajando más cuando algo se rompe, sino haciendo que se rompa menos y se recupere más rápido.