Lead SRE Engineer (Ref - Inf)

Consultoria IT · Remoto

Inscribirme

Descripción

Empresa de soluciones Informatica está en la búsqueda de un Lead SRE Engineer (Ref - Inf) experimentado y altamente cualificado para unirse a nuestro equipo. El candidato ideal poseerá una sólida trayectoria en ingeniería de confiabilidad de sitios, con un mínimo de 5 años de experiencia profesional. Este rol es crucial para diseñar, construir y mantener sistemas a gran escala, asegurando la máxima disponibilidad, rendimiento y escalabilidad de nuestras plataformas. Se espera que el candidato lidere iniciativas técnicas, guíe a otros ingenieros y colabore estrechamente con equipos de desarrollo y operaciones para implementar las mejores prácticas de SRE.


Responsabilidades Clave:

  • Diseñar, implementar y gestionar arquitecturas de sistemas robustos y escalables, priorizando la confiabilidad y la eficiencia.
  • Desarrollar y mantener pipelines de CI/CD automatizados para la entrega continua de software, optimizando los procesos de despliegue y asegurando la calidad.
  • Establecer y monitorizar métricas clave de rendimiento (SLOs, SLIs) y objetivos de nivel de servicio, utilizando herramientas de observabilidad para garantizar la salud del sistema.
  • Liderar la resolución de incidentes complejos, realizar análisis post-mortem exhaustivos y definir acciones correctivas para prevenir futuras recurrencias.
  • Colaborar con los equipos de desarrollo para integrar principios de SRE desde las primeras etapas del ciclo de vida del desarrollo de software (shift-left).
  • Automatizar tareas operativas repetitivas y de bajo valor, liberando tiempo para la innovación y la mejora continua.
  • Participar activamente en la planificación de la capacidad y la gestión de recursos para asegurar el rendimiento óptimo y la rentabilidad de la infraestructura.
  • Mantener y mejorar la infraestructura de nube (AWS, GCP, Azure, PCF, VMware) y las bases de datos (PostgreSQL, Cassandra, Redis).
  • Gestionar y optimizar las configuraciones de red, incluyendo balanceadores de carga, proxies y firewalls.
  • Asegurar la correcta gestión de certificados y la seguridad de los sistemas.
  • Mentorear y guiar a ingenieros junior, fomentando una cultura de aprendizaje y excelencia técnica.
  • Contribuir a la definición y aplicación de estándares de seguridad y cumplimiento normativo (ITIL).



Requisitos

  • Experiencia: Mínimo de 5 años de experiencia demostrable en Ingeniería de Confiabilidad de Sitios (SRE), DevOps o roles similares.
  • Programación y Scripting: Sólido dominio de lenguajes como Java, Python, Go, y experiencia en scripting de shell, PowerShell, Groovy. Profundo conocimiento de algoritmos y estructuras de datos.
  • Nube e Infraestructura: Experiencia práctica con plataformas cloud como AWS, GCP, Azure, y conocimiento profundo de PCF y VMware. Experiencia en el diseño de sistemas altamente escalables.
  • Tecnologías de Bases de Datos: Dominio de bases de datos relacionales y NoSQL, incluyendo PostgreSQL, Cassandra, y Redis. Experiencia avanzada en consultas SQL.
  • Monitorización y Observabilidad: Familiaridad y experiencia práctica con herramientas líderes en el mercado como Splunk, Dynatrace, BlazeMeter, ThousandEyes, BrowserStack, AppDynamics.
  • Conceptos y Herramientas de CI/CD: Experiencia en la implementación y gestión de flujos de trabajo de integración y entrega continua (CI/CD), incluyendo estrategias de ramificación, SCM, Artifactory, SonarQube, Jenkins, XLR, Habitat, Ansible, Chef Infra.
  • Conceptos de Redes: Comprensión sólida de los protocolos de red (TCP/IP), herramientas de diagnóstico como Wireshark, y experiencia con balanceadores de carga (F5), proxies y protocolos de transferencia de archivos (FTP/SFTP).
  • Gestión de Certificados: Experiencia en la gestión de certificados digitales utilizando herramientas como Venafi, ECMS, y OpenSSL.
  • ITSM y Cumplimiento Normativo: Conocimiento del marco ITIL y experiencia en la aplicación de principios de gobernanza operativa.
  • Habilidades de Liderazgo: Capacidad probada para liderar equipos técnicos, mentorizar a otros y gestionar proyectos de manera efectiva.
  • Resolución de Problemas: Excelentes habilidades analíticas y de resolución de problemas, con la capacidad de abordar desafíos técnicos complejos de manera metódica.
  • Comunicación: Habilidades de comunicación verbal y escrita excepcionales, con la capacidad de interactuar eficazmente con stakeholders técnicos y no técnicos.


Deseable (No Excluyente):

  • Certificaciones relevantes en tecnologías cloud (AWS, GCP, Azure) o SRE.
  • Experiencia en entornos de alta disponibilidad y tolerancia a fallos.
  • Conocimiento de arquitecturas de microservicios y contenedores (Docker, Kubernetes).