Trayectoria
Experiencia y certificaciones
Más de 4 años operando sistemas en producción, de 500+ servidores en manufactura a una flota cloud de ~15,000 hosts.
Experiencia
Opero y mantengo una flota de hypervisors bare-metal (OCI sobre sustrato OCI) en varias regiones y dominios de disponibilidad, y doy soporte al provisioning de endpoints para nuevas regiones.
- Piloteé un auto-resolver de phantom tickets que adoptó todo el equipo: 70% de esa categoría automatizada y −45–55% de tiempo por ticket.
- Reescribí y estandaricé runbooks y artículos de conocimiento: ~60% menos escalaciones.
- Parches y upgrades de hypervisors en flotas de producción con cero downtime no planeado, health checks antes y después y registros de cumplimiento completos.
- Automaticé las solicitudes de cuota: menos de 2 minutos por solicitud.
- SME de guardia en bridges de incidentes mayores (NOC/LSE) en varias regiones: triage, evaluación de impacto y seguimiento post-incidente.
- Desarrollo un agente de operaciones con IA en Python con metas de precisión/recall, ciclos de QA y humano en el ciclo.
- Hardening de la flota: mínimo privilegio, auditorías de credenciales y remediación de vulnerabilidades.
- CI/CD para herramientas de operación (canary, pruebas automatizadas, rollback) y dashboards de KPI/SLO: disponibilidad, MTTR, tasa de errores y cobertura de automatización.
Proyectos de infraestructura y migraciones cloud. Proyecto actual: la infraestructura de una plataforma que digitaliza el control de ~3,500 máquinas tragamonedas (red, cómputo, base de datos con mTLS, runtime Java/Tomcat y despliegues).
Asistente de investigación con Python y participante activo de la comunidad de ciberseguridad de Nearshore Cyber y Project Aramis.
Sistemas de producción en un entorno mixto Windows/Linux de más de 500 servidores, con foco en parcheo confiable, automatización y cumplimiento de SLAs.
- Parches y upgrades de 500+ servidores Windows y Linux en ventanas programadas, con 85–90% de cumplimiento en la flota.
- Scripts en Bash y PowerShell que acortaron las ventanas de parcheo y redujeron el downtime no planeado.
- Configuración y administración de VMs en VMware ESXi para sistemas de manufactura.
- Runbooks y documentación de incidentes para estandarizar la resolución en varios sistemas operativos.
Certificaciones y cursos
Aprendizaje verificable
Cada credencial con su enlace de verificación cuando el emisor lo ofrece.