Nava Technology for Business
Analista SRE Senior – Posición de Acción Afirmativa para Mujeres
Show originalPresencial
São Paulo, SP, Brasil
Rango salarial
R$ 14.000,00 - R$ 15.000,00 / mes
Empleado(a)
Nivel de experiencia
Senior
Requisitos
Tareas y Responsabilidades
Show originalEstamos buscando un Ingeniero de Confiabilidad del Sitio (SRE) para actuar como guardián de la confiabilidad, estabilidad y rendimiento de nuestros productos y servicios. Si te gusta trabajar en entornos críticos, tomar decisiones basadas en datos y fomentar una cultura sin culpas, este puesto puede ser para ti.
🎯 Misión del Cargo
Garantizar que nuestros sistemas operen con alta confiabilidad, eficiencia y previsibilidad, equilibrando la velocidad de entrega y la robustez operativa. El SRE será una pieza clave en la evolución de la madurez técnica del equipo y en el mantenimiento de servicios críticos.
El profesional trabajará en un turno de guardia rotativo, respondiendo a incidentes dentro de los SLAs definidos, liderando estabilizaciones rápidas, participando en postmortems sin culpas y proponiendo mejoras continuas para reducir la recurrencia. El turno de guardia sigue las políticas internas de compensación.
Principales Responsabilidades
Confiabilidad y Gobernanza
Definir, mantener y evolucionar SLIs y SLOs de APIs críticas
Gestionar presupuestos de error y apoyar decisiones de lanzamiento
Actuar como referencia en el equilibrio entre agilidad y estabilidad
Observabilidad y Operaciones
Implementar y evolucionar monitoreo, métricas, registros y trazabilidad
Garantizar alertas accionables y dashboards eficientes
Liderar o apoyar respuestas a incidentes y salas de guerra
Gestión de Incidentes
Estructurar y ejecutar procesos de respuesta a incidentes sin culpas
Conducir postmortems y garantizar acciones correctivas
Centrarse en la reducción de MTTA, MTTR y recurrencia
Automatización y Reducción de Toil
Automatizar tareas repetitivas y flujos operativos
Crear libros de ejecución, automatizaciones y mejoras en CI/CD
Estandarizar procesos de lanzamiento, reversión y pruebas de resiliencia
Infraestructura y Rendimiento
Trabajar con Kubernetes/EKS, Azure DevOps, Kafka y bases de datos
Requisitos Obligatorios
Experiencia en Ingeniería, Infraestructura, Plataforma o SRE/DevOps
Experiencia con SLO, SLI, presupuesto de error y gestión de incidentes
Fuerte habilidad en resolución de problemas y RCA (Análisis de Causa Raíz)
Tecnologías
Kubernetes/EKS, Azure DevOps
Observabilidad: Prometheus, Grafana, ELK, CloudWatch, X-Ray
Kafka, Oracle, MySQL
Seguridad operativa e IAM
Lenguajes y Automatización
Bash, PowerShell, Python
Ansible, Terraform, Helm
Deseable: .NET Framework y .NET Core
Se requiere disponibilidad para trabajar en modelo híbrido en la región de Vila Olímpia en São Paulo, de 1 a 2 veces por semana.
Compartir vacante:
Compartir vacante: