Tema

Proyecto destacado

Domestika: transformación de infraestructura DevOps y cloud

Lideramos la modernización integral de la infraestructura cloud para una plataforma de aprendizaje creativo en rápido crecimiento, implementando arquitectura AWS multi-región y automatización DevOps completa que respaldaron el crecimiento de la empresa de 20 empleados a unicornio.

Contexto del proyecto

Cuando nos incorporamos a Domestika en noviembre de 2017, la plataforma de aprendizaje creativo era una startup en rápido crecimiento con apenas 20 empleados. Como primer arquitecto cloud e ingeniero DevOps dedicado, asumimos la responsabilidad de construir y mantener toda la infraestructura cloud que respaldaría el explosivo crecimiento de la empresa durante los siguientes tres años. Llegamos a ser Head of Infrastructure conforme el equipo se expandía.

Arquitectura de infraestructura AWS multi-región de Domestika

Durante nuestra colaboración, la empresa evolucionó desde una operación centrada en España y Latinoamérica hasta convertirse en una plataforma global que alcanzó el estatus de unicornio con una valoración superior a los 1.000 millones de dólares y cientos de empleados. La infraestructura que diseñamos y mantuvimos fue fundamental para soportar este crecimiento, escalando de miles a millones de usuarios sin comprometer la estabilidad ni el rendimiento.

En octubre de 2020, la empresa había alcanzado tal escala y madurez que concluimos que nuestra misión estaba cumplida. Decidimos marcharnos, ya que disfrutamos del reto de hacer crecer empresas más pequeñas y startups donde el impacto de nuestro trabajo es más inmediato y palpable, en lugar de trabajar en organizaciones grandes y ya consolidadas.

El desafío técnico

Domestika enfrentaba varios desafíos críticos que requerían soluciones inmediatas y planificación estratégica a largo plazo:

Crecimiento explosivoEscalar rápidamente desde el mercado hispanohablante para servir a millones de usuarios globalmente con una experiencia de usuario excepcional.
Contenido multimedia pesadoEntregar vídeos de cursos creativos e imágenes de proyectos en alta resolución con baja latencia mundial mientras se controlan los costes de ancho de banda.
Infraestructura heredadaReemplazar procesos manuales de despliegue y arquitectura monolítica con automatización adecuada e infraestructura moderna.
Requisitos empresarialesImplementar monitorización exhaustiva, recuperación ante desastres, seguridad robusta para pagos y datos de usuarios, y optimización de costes.

Arquitectura y soluciones implementadas

Infraestructura como código y arquitectura multi-región

Diseñamos e implementamos una arquitectura AWS multi-región completamente gestionada mediante Terraform, proporcionando control de versiones completo de todos los cambios de infraestructura y permitiendo despliegues consistentes y repetibles. Inicialmente centrada en servir a España y Latinoamérica, la arquitectura evolucionó para dar soporte global conforme la empresa se expandía internacionalmente.

La estrategia de red incluyó configuraciones VPC personalizadas para cada entorno (producción, staging e interno) con segmentación adecuada, implementando seguridad en profundidad mediante security groups y ACLs de red. Esta base sólida de infrastructure as code facilitó la colaboración conforme el equipo crecía y permitió recuperación automatizada ante desastres mediante recreación de infraestructura.

Diseño de arquitectura de red VPC de Domestika

Optimización de entrega de contenido multimedia

Uno de los proyectos más impactantes fue la optimización del sistema de gestión y entrega de imágenes de la plataforma. Domestika alojaba millones de imágenes en alta resolución de cursos y proyectos creativos que consumían ancho de banda excesivo y generaban costes significativos.

Inicialmente desarrollamos un sistema interno de procesamiento de imágenes que utilizaba un pipeline serverless con CloudFront CDN, colas de procesamiento y scripts automatizados de optimización con ImageMagick y MozJPEG. Este sistema interceptaba solicitudes de imágenes no optimizadas, las procesaba bajo demanda y las servía a través de la red de edge locations de CloudFront.

Posteriormente, conforme las necesidades de la empresa evolucionaron y el catálogo de imágenes creció exponencialmente, migramos el sistema completo a Cloudinary, una plataforma especializada en gestión de medios que ofrecía capacidades avanzadas perfectamente alineadas con las necesidades de Domestika. Esta migración simplificó significativamente la arquitectura mientras mejoraba el rendimiento y reducía los costes operacionales.

Gestión de bases de datos y migraciones críticas

Lideramos la actualización de las bases de datos de producción de MySQL 5.7 a 8.0, un proyecto complejo que requirió pruebas exhaustivas en staging, análisis cuidadoso de compatibilidad de consultas y coordinación de ventanas de migración con enfoque de mínimo tiempo de inactividad.

Implementamos una arquitectura de replicación robusta con configuración maestro-réplica para escalado de lecturas y una réplica dedicada para backups con capacidad de recuperación point-in-time. Desarrollamos scripts inteligentes que pausaban automáticamente la replicación durante las ventanas de backup y calculaban tiempos óptimos de supresión de alertas en Datadog basándose en la duración histórica de los backups, evitando falsas alertas mientras mantenían la cobertura de monitorización.

Seguridad y acceso

Implementamos AWS WAF (Web Application Firewall) protegiendo contra ataques de inyección SQL, XSS y DDoS mediante pattern sets personalizados y limitación de tasa. Diseñamos un sistema de bastion hosts para acceso seguro a la infraestructura interna con aprovisionamiento automatizado de usuarios, gestión de claves SSH, logging exhaustivo de auditoría y autenticación de dos factores para sistemas sensibles.

La seguridad de red implementaba defensa en profundidad con configuraciones personalizadas de firewall, security groups siguiendo principios de mínimo privilegio, segmentación entre capas de aplicación y acceso VPN para el equipo remoto.

DevOps y automatización

Configuramos y mantuvimos la infraestructura completa de CI/CD con Jenkins, automatizando builds activados por commits en Git, pipelines de despliegue para staging y producción, integración con AWS CodeDeploy, comprobaciones de salud post-despliegue con rollback automático y tracking de errores.

Desarrollamos funciones Lambda para automatización serverless incluyendo gestión dinámica de instancias EC2 basada en carga, logging centralizado, gestión automatizada del ciclo de vida de índices de Elasticsearch y actualización dinámica de security groups. También creamos herramientas CLI personalizadas que simplificaron dramáticamente las operaciones comunes, reduciendo tareas administrativas multi-paso a comandos únicos.

Monitorización y observabilidad

Implementamos monitorización exhaustiva con Datadog cubriendo toda la infraestructura (EC2, RDS, ElastiCache, Elasticsearch, balanceadores de carga) y aplicaciones (Ruby on Rails, colas Sidekiq, servidores web, trabajos en segundo plano). Desarrollamos checks personalizados con umbrales inteligentes y creamos un sistema de alertas con supresión automatizada durante ventanas de mantenimiento, umbrales dinámicos basados en patrones históricos e integración con PagerDuty para rotación de guardia.

Recuperación ante desastres

Desarrollamos un sistema integral de snapshots con backups diarios de volúmenes EBS para todas las instancias críticas, gestión automatizada de retención y replicación entre regiones. Implementamos protección multi-capa de contenido S3 con sincronización recursiva a almacenamiento de backup, gestión de transferencias concurrentes y pruebas regulares de restauración validando la integridad.

Proporcionamos múltiples estrategias de recuperación de base de datos incluyendo restauración completa desde exports comprimidos, recuperación point-in-time usando binary logs y recuperación rápida basada en snapshots, cada una con RTO y RPO documentados.

Tecnologías utilizadas

Plataforma cloud: AWS (EC2, RDS, ElastiCache, Elasticsearch, S3, CloudFront, Route53, VPC, Lambda, DynamoDB, WAF).

Infrastructure as Code: Terraform, Git.

Stack de aplicación: Ruby on Rails, Unicorn, Puma, Sidekiq, Redis, MySQL 8, Elasticsearch.

Optimización de medios: Cloudinary (producción), ImageMagick, MozJPEG (sistema inicial).

CI/CD y automatización: Jenkins, AWS CodeDeploy, scripts Python y Bash, Lambda.

Monitorización: Datadog, PagerDuty.

Impacto y resultados

Escala global logradaEscalado exitoso de miles a millones de usuarios con alta disponibilidad y estabilidad a nivel mundial.
Optimización de costesReducción drástica de costes de entrega de contenido mientras se mejoraba significativamente la experiencia del usuario mediante caché inteligente y optimización CDN.
Excelencia operacionalLa automatización exhaustiva minimizó intervenciones manuales y mejoró el tiempo medio de recuperación ante incidentes.
Cero incidentes de seguridadArquitectura de seguridad robusta con enfoque de defensa en profundidad garantizó cero incidentes durante toda la permanencia.
Productividad del equipoLas herramientas operacionales personalizadas incrementaron dramáticamente la productividad del equipo técnico al simplificar tareas complejas.
Éxito unicornioLa infraestructura permitió el crecimiento de la empresa de startup de 20 personas a unicornio con valoración de más de $1.000 millones y cientos de empleados.

Esta experiencia reforzó la importancia de construir para escalar desde el principio, invertir en automatización tempranamente y mantener una mentalidad de seguridad primero en todas las decisiones arquitectónicas. Trabajar con Domestika durante esta fase crítica de crecimiento proporcionó experiencia invaluable en arquitectura cloud, prácticas DevOps y construcción de infraestructura que verdaderamente habilita el éxito empresarial.


¿Buscas construir algo similar?

Para empresas que experimentan un rápido crecimiento y necesitan infraestructura cloud escalable que maneje:

  • Despliegues multi-región con entrega de contenido de baja latencia a nivel mundial.
  • Infrastructure as Code para infraestructura versionada y repetible.
  • Pipelines CI/CD automatizados con despliegues sin tiempo de inactividad.
  • Monitorización y alertas exhaustivas para gestión proactiva de incidentes.
  • Optimización de medios rentable a escala.

El stack AWS + Terraform + automatización DevOps mostrado en el ejemplo de Domestika proporciona una base probada en batalla para plataformas de alto crecimiento.

Estamos disponible para consultoría y desarrollo en proyectos similares de modernización de infraestructura, ayudándote a construir arquitecturas cloud escalables, seguras y rentables que habiliten el éxito empresarial.

Ponte en contacto →

Daniel López Azaña

Sobre el autor

Daniel López Azaña

+25 años de experiencia Certificado AWS & GCP Especialista IA/LLM

Emprendedor tecnológico y arquitecto cloud con más de 25 años de experiencia transformando infraestructuras y automatizando procesos. Especialista en integración de IA/LLM, desarrollo con Rust y Python, y arquitectura AWS & GCP. Mente inquieta, generador de ideas y apasionado por la innovación tecnológica y la IA.

Comentarios

Sé el primero en comentar

Enviar comentario

Se publicarán tu nombre y tu comentario. Tu correo no se publica y solo sirve para responderte. Detalles en la política de privacidad.

¿Listo para transformar tu negocio?

Cuéntanos tu proyecto y exploremos juntos cómo la tecnología puede ayudarte a alcanzar tus objetivos.

O, si lo prefieres, escríbenos directamente a: info@navat.ai

Tu nombre y tu correo se usan solo para responderte. No se publican, no se ceden y no reciben publicidad. Detalles en la política de privacidad.