ZG Soluções

Analista SRE Senior

Show original

Remoto

(Cualquier lugar)

Rango salarial

BRL

Empleado(a)

Nivel de experiencia

Senior

Requisitos

5+ años de experiencia en la carrera
Terraform
Ansible
Virtualization
Kubernetes
Docker
Linux

Habilidades deseadas

Automação & CI/CD
PostgreSQL
Prometheus, Grafana, ELK, Datadog

Tareas y Responsabilidades

Show original

Buscamos un profesional Senior de Infraestructura y Confiabilidad con experiencia comprobada en entornos productivos críticos.

Nuestros entornos son híbridos: cargas en nube pública, cargas en centros de datos con virtualización y cargas dentro de la infraestructura privada de nuestros clientes. Esto requiere alguien que domine los fundamentos (redes, virtualización y Linux) y automatice todo lo que sustenta esta base.

Al trabajar con nosotros, serás responsable de aprovisionar infraestructura de forma automatizada, operar nuestros clusters de Kubernetes en producción y garantizar la resiliencia y observabilidad de las aplicaciones en todos estos entornos.

Evaluamos la profundidad técnica y la capacidad de diagnóstico. No evaluamos la visibilidad, conferencias ni presencia en redes sociales.


RESPONSABILIDADES Y ATRIBUCIONES

• Automatizar el aprovisionamiento y la configuración de la infraestructura con Terraform y Ansible;

• Operar y evolucionar clusters de Kubernetes en producción, incluyendo redes, almacenamiento, RBAC y estrategias de actualización;

• Construir y mantener imágenes y contenedores Docker ligeros y reproducibles;

• Mantener la conectividad entre nuestros entornos y los de los clientes: enrutamiento, VPN, DNS, TLS, firewall y proxy inverso;

• Administrar y escalar la capa de virtualización y los sistemas Linux que soportan la plataforma;

• Mantener y evolucionar la arquitectura con enfoque en resiliencia y alta disponibilidad;

• Evolucionar la pipeline de CI/CD y la entrega mediante GitOps (ArgoCD);

• Promover la observabilidad y el monitoreo con Prometheus, Grafana y Zabbix, reduciendo el ruido de alertas;

• Liderar el análisis de incidentes hasta la causa raíz y transformarlos en correcciones estructurales documentadas;

• Soportar la operación de aplicaciones Java y bases de datos PostgreSQL en producción;

• Promover la gestión de seguridad en los servidores y servicios del ecosistema.


REQUISITOS Y CUALIFICACIONES

Los siguientes requisitos son innegociables para esta posición. Esperamos que puedas explicar cada uno en profundidad, con ejemplos de tu trabajo:

• Experiencia sólida como SRE, DevOps o Infraestructura en entornos productivos críticos, con participación directa en incidentes de impacto real;

• Dominio de redes: TCP/IP, enrutamiento, DNS, NAT, TLS/SSL, VPN, firewall y proxy inverso con NGINX;

• Experiencia en administración de virtualización en producción, preferiblemente Proxmox (VMware, KVM o equivalentes también son considerados);

• Operación avanzada de Linux y automatización con Shell/Bash;

• Automatización de aprovisionamiento con Terraform y Ansible en uso real y mantenido a lo largo del tiempo;

• Gestión de clusters de Kubernetes en producción, con capacidad para investigar y resolver fallos de carga de trabajo, tráfico y nodos;

• Construcción, actualización y gestión de imágenes y contenedores Docker;

• Experiencia en procesos de CI/CD y entrega mediante GitOps (ArgoCD o equivalente);

• Experiencia con herramientas de monitoreo y observabilidad (Prometheus, Grafana, Zabbix);

• Control de versiones con Git como práctica diaria;

• Autonomía para asumir problemas mal definidos, investigarlos a fondo y entregar soluciones;

• Comunicación clara y documentación técnica de calidad, especialmente durante incidentes.


DESTACARÁS SI TIENES

• Experiencia en entornos con requisitos regulatorios (salud, finanzas o sector público) y familiaridad con la LGPD (Ley General de Protección de Datos de Brasil);

• Experiencia en resolución de problemas en sistemas distribuidos y fallos intermitentes;

• Experiencia con middleware, servidores de aplicaciones Java, colas de mensajes y API Gateways;

• Práctica en hardening, gestión de secretos y gestión de vulnerabilidades;

• PostgreSQL a nivel de ajuste, replicación y recuperación;

• Certificaciones que respalden tu práctica (CKA/CKS, RHCE, LPIC, redes o nube);

• Capacidad para escribir tus propias herramientas cuando no existen listas (Python, Go o equivalente);

• Uso de IA en el trabajo técnico diario para construir herramientas, automatizaciones y acelerar la resolución de problemas.


ESTA VACANTE NO ES PARA TI SI

• Tu experiencia con Kubernetes se limita a aplicar manifiestos escritos por otra persona;

• Tratas la red como una caja negra y escalas a terceros lo que no está en la aplicación;

• Aprovisionas mediante consolas gráficas y no utilizas control de versiones para la infraestructura.


Compartir vacante:

Compartir vacante: