Want to know if this job is worth applying to?
Ciudad de Guatemala, Departamento de Guatemala, Guatemala
Remote only
We are One Team. We make it happen. We are Unstoppable.
Babel, enriching people through technology
BABEL es una consultora tecnológica multinacional especializada en aplicar sus servicios y conocimiento tecnológico en los procesos de aceleración digital de sus clientes, grandes empresas y organismos públicos.
¿Cuál es nuestro plan estratégico?
¡Miramos hacia el futuro! Nuestro plan estratégico Hiperespacio 2029 promete ser un viaje emocionante, lleno de oportunidades para crecer y desarrollarse profesionalmente. Alcanzar 1000 millones de facturación, un reto que estamos seguros de que con la colaboración y el talento de nuestra gente, será otra historia de éxito que escribiremos juntos y juntas.
¿Qué buscamos?
Objetivo del Rol
Garantizar la confiabilidad, disponibilidad, estabilidad y rendimiento de las aplicaciones y servicios asignados, participando activamente en su operación, monitoreo y mejora continua en entornos Cloud y Kubernetes/WCNP.
El Site Reliability Engineer (SRE) Junior+ será responsable de monitorear aplicaciones, realizar troubleshooting de incidentes de baja y mediana complejidad, analizar logs, métricas, dashboards y alertas, apoyar la ejecución y estabilización de despliegues, así como desarrollar automatizaciones que reduzcan tareas manuales y mejoren la eficiencia operativa.
El rol contribuirá a la adopción de prácticas de Site Reliability Engineering (SRE), participando en la definición y seguimiento de indicadores de confiabilidad (SLIs, SLOs, Error Budgets, disponibilidad y MTTR), análisis de causa raíz (RCA), observabilidad y mejora continua de los servicios.
Se espera que la persona pueda desenvolverse con un nivel moderado de autonomía, identificando cuándo resolver una situación de forma independiente y cuándo escalarla oportunamente a equipos especializados.
Bachillerato universitario en Ingeniería en Sistemas, Ingeniería en Computación o carrera afín.
Experiencia
Entre 1 y 2 años de experiencia en funciones relacionadas con:
Site Reliability Engineering (SRE)
DevOps
Cloud Engineering
Platform Engineering
Operación de aplicaciones
Durante esta experiencia se espera participación práctica en varios de los siguientes componentes:
Kubernetes y contenedores.
Observabilidad y monitoreo.
Troubleshooting de aplicaciones.
Análisis de logs y métricas.
Pipelines CI/CD.
Git.
Automatización con Python y/o Bash.
Plataformas Cloud.
Atención de incidentes productivos.
Responsabilidades
Monitorear la disponibilidad, estabilidad y rendimiento de las aplicaciones y servicios.
Participar en la operación y estabilización de aplicaciones desplegadas sobre Kubernetes/WCNP.
Analizar logs, métricas, eventos y alertas para diagnosticar incidentes.
Resolver incidentes de baja y mediana complejidad, escalando oportunamente aquellos de mayor criticidad.
Configurar y mantener dashboards, métricas y mecanismos de monitoreo.
Apoyar la definición y seguimiento de SLIs, SLOs y Error Budgets.
Dar seguimiento a indicadores como disponibilidad, MTTR y recurrencia de incidentes.
Participar en análisis de causa raíz (RCA) e implementación de acciones correctivas.
Desarrollar scripts y automatizaciones utilizando Python, Bash u otras herramientas.
Identificar oportunidades para reducir tareas manuales (toil) mediante automatización.
Participar en la ejecución y troubleshooting de pipelines CI/CD.
Gestionar repositorios y control de versiones mediante Git.
Apoyar procesos de despliegue, migración y estabilización de aplicaciones en plataformas Cloud y Kubernetes.
Colaborar en iniciativas de optimización de recursos y costos en la nube.
Utilizar herramientas de Inteligencia Artificial como apoyo para análisis de logs, troubleshooting, generación de scripts y documentación técnica.
Mantener actualizados runbooks, documentación técnica y procedimientos operativos.
Participar en iniciativas de mejora continua relacionadas con confiabilidad, observabilidad, resiliencia y automatización.
Colaborar con equipos de Desarrollo, DevOps, Cloud, Infraestructura y Soporte para asegurar la estabilidad de las plataformas.
Conocimientos Técnicos
Indispensables
Kubernetes (nivel intermedio operativo).
Docker y contenedores.
Grafana.
Prometheus o herramientas equivalentes de monitoreo.
Observabilidad y monitoreo de aplicaciones.
Análisis de logs y métricas.
Python y/o Bash.
Git.
Pipelines CI/CD.
Azure, GCP, AWS o plataformas Cloud equivalentes.
Linux.
Troubleshooting de aplicaciones.
Gestión y atención de incidentes.
Conocimiento práctico de:
SLIs
SLOs
Error Budgets
MTTR
Root Cause Analysis (RCA)
Deseables
WCNP.
Concord.
Looper.
Terraform.
Ansible.
OpenTelemetry.
Plataformas de centralización y análisis de logs.
Distributed Tracing.
FinOps.
Métricas DORA.
Capacity Planning.
Pruebas de resiliencia y disponibilidad.
Chaos Engineering.
Herramientas de IA aplicadas a operaciones (AIOps).
Se espera que el candidato pueda trabajar con Kubernetes a nivel operativo, incluyendo revisión de pods, deployments, services, eventos, logs y troubleshooting básico/intermedio de aplicaciones desplegadas en la plataforma.
No se espera un especialista en todas las tecnologías, pero sí un profesional con experiencia práctica suficiente para desenvolverse con autonomía en la operación diaria.
#babel
¿Quieres formar parte de un equipo en expansión, comprometido e innovador que hace historia cada día? En Babel te acompañamos en tu camino hacia el éxito. Creemos en el talento de las personas y lo queremos potenciar.
Trabajar en Babel es mucho más que trabajar en una empresa, es unirse a un equipo de personas con una misión compartida y a un modelo de compañía centrado en valores.
Y lo hacemos promoviendo la diversidad, la equidad y la inclusión, garantizando la igualdad de oportunidades a todas las personas candidatas, en un entorno libre de cualquier tipo de discriminación.
Además,
• Foco en trabajar con últimas tecnologías y proyectos innovadores, pero sobre todo, acompañamos a la transformación digital y acercamos la tecnología a la sociedad.
• Comunicación y transparencia: Siempre estarás informado de las últimas noticias de la compañía.
• Contribuimos a la formación constante de nuestros Babelievers.
• Programa de promociones profesionales y desarrollo de talento.
• Trabajo con proyectos de diversos países lo que nos permite aprender de diferentes culturas.
• Contribuimos en tu salud física y emocional (Charlas, competencias deportivas).
• Participamos del crecimiento de la compañía, reconocemos la participación de cada persona con nuestro bono solidario.
• Apostamos por la flexibilidad laboral – personal.
• Bono por referidos.
• Convenios comerciales según sede.
¿Aceptas el desafío? ¡Te esperamos!
En cumplimiento de la normativa vigente en materia de protección de datos te informamos que el responsable de tus datos personales es GRUPO BABEL (consultar empresas en la política de privacidad), y los utilizará para gestionar tus procesos de selección, tanto actuales como futuros y el resto de finalidades descritas en la web. Este tratamiento está basado en el consentimiento del candidato. Los datos personales recabados no serán en ningún caso cedidos a terceros salvo por obligaciones legales expresas. Puedes ejercer los derechos que te asisten sobre protección de datos en la dirección data.protection@babelgroup.com. Toda la información sobre política de privacidad en nuestra web.