Líder Técnico SRE y Observabilidad

Company: TalyCap Global
Location: Bogotá, CO
Type:
Posted: Sep 24, 2026
Views: 1

✨ AI Summary

Talycap Global busca un Líder Técnico SRE y Observabilidad en Bogotá para dirigir estrategias de confiabilidad en entornos híbridos y multicloud. El stack principal incluye AWS, Azure, Dynatrace, Datadog, Prometheus y Grafana. Se requieren entre 5 y 6 años de experiencia en infraestructura, con al menos 2 años específicos en SRE, observabilidad y automatización.

🎯 Objetivo del Cargo

Buscamos un Líder Técnico SRE y Observabilidad para participar en un proyecto de alto impacto, liderando la definición e implementación de estrategias de observabilidad y confiabilidad de plataformas. Será responsable de impulsar prácticas de monitoreo proactivo, gestión de incidentes, automatización y mejora continua, contribuyendo a la disponibilidad, estabilidad y rendimiento de entornos tecnológicos híbridos y multicloud.

✅ Requisitos Indispensables

Formación Académica

  • Profesional en Ingeniería de Sistemas.

  • Profesional en Ingeniería de Software.

  • Profesional en Ingeniería Electrónica.

  • Carreras afines.

Experiencia

  • Entre 5 y 6 años de experiencia en infraestructura, operaciones TI, plataformas o ingeniería de software.

  • Mínimo 2 años en roles relacionados con SRE (Site Reliability Engineering).

  • Mínimo 2 años en roles relacionados con Observability.

  • Mínimo 2 años en Reliability Engineering o Performance Engineering.

  • Mínimo 2 años de experiencia en automatización.

  • Experiencia en liderazgo técnico.

  • Experiencia coordinando iniciativas o células de trabajo.

⚙️ Conocimientos Técnicos Indispensables

Observabilidad

  • Diseño e implementación de estrategias de observabilidad.

  • Monitoreo end-to-end.

  • Observabilidad en entornos híbridos.

  • Observabilidad en entornos multicloud.

  • Gestión de métricas.

  • Gestión de logs.

  • Gestión de trazas.

  • Monitoreo proactivo.

Herramientas de Observabilidad

  • Experiencia en al menos una de las siguientes:

    • Dynatrace.

    • Datadog.

    • New Relic.

    • Prometheus.

    • Grafana.

SRE

  • SLI.

  • SLO.

  • SLA.

  • Incident Management.

  • Problem Management.

  • Root Cause Analysis (RCA).

  • Capacity Planning.

  • Error Budgets.

  • Capacidad para definir e implementar prácticas SRE.

Cloud

  • AWS.

  • Azure.

Automatización

  • Automatización operativa.

  • Self-Healing.

⭐ Conocimientos Deseables

Certificaciones

  • SRE Foundation.

  • SRE Practitioner.

  • Dynatrace.

  • Datadog.

  • New Relic.

  • Prometheus.

  • Grafana.

  • AWS.

  • Azure.

Performance Engineering

  • Pruebas de carga.

  • Pruebas de estrés.

  • Chaos Engineering.

SAP

  • SAP RISE.

  • SAP Clean Core.

  • SAP Activate.

  • SAP Basis Cloud.

About the Company

Name: TalyCap Global

Somos una empresa referente y especialista en talento humano principalmente del nicho de tecnología, apoyamos a nuestros clientes incorporando talento humano especializado para sus proyectos con servicios flexibles a las necesidades en la modalidad de Staffing o Headhunting.

More jobs at TalyCap Global