Geekhunter Logo

Soluciones

Software de Reclutamiento

Publica vacantes, importa perfiles, pre-califica candidatos con preguntas personalizadas y controla todo el reclutamiento en un solo lugar.

Servicio de Reclutamiento

Confía en nosotros para encontrar tu talento tech. Con nuestro equipo especializado actuamos en las principales etapas de reclutamiento.

Base de talentos

Los mejores talentos tech de Brasil, todos pre-seleccionados y listos para nuevas oportunidades.

Nuestros planes

Descubre el plan perfecto para tus necesidades.

Iniciar sesión

Español

ES

Dell Technologies | Radancy

Ingeniero(a) Senior de Confiabilidad de Sitios (SRE) – Servidor

Show original

Presencial

Eldorado do Sul, RS, Brasil

Rango salarial

No informada

Empleado(a)

Nivel de experiencia

Senior

Requisitos

5+ años de experiencia en la carrera
Inglês avanzado
Ansible
Oracle Linux
Git
Windows Server
Observabilidade
VMware vSphere
GitOps
Monitoramento
SRE
RHEL
CI/CD
Linux
Python
vCenter

Habilidades deseadas

Zabbix
Kickstart
Packer
vROps
LLM
GitLab CI
Dynatrace
PCI-DSS
SOX
NetBox
ISO 27001
Preseed
Agentic AI
ServiceNow CMDB

Tareas y Responsabilidades

Show original

Únase a nosotros como Ingeniero(a) Senior de Confiabilidad de Sitios (SRE) en nuestro equipo de Ingeniería de Infraestructura en Eldorado do Sul/RS para realizar el mejor trabajo de su carrera y generar un profundo impacto social.


Como Ingeniero(a) Senior de Confiabilidad de Sitios (SRE), será responsable de diseñar, desarrollar y gestionar automatizaciones para todo el ciclo de vida de la infraestructura de cómputo, garantizando la escalabilidad, disponibilidad y confiabilidad de los servicios. Trabajará con equipos de Ingeniería de Cómputo, Automatización de Plataformas y Observabilidad en una plataforma corporativa basada en automatización, soportando cargas de trabajo críticas e impulsando la excelencia operativa mediante prácticas modernas de SRE y automatización a gran escala.



Lo que hará


  • Diseñar, desarrollar y mantener automatizaciones para todo el ciclo de vida de la infraestructura de cómputo, incluyendo descubrimiento de servidores, aprovisionamiento bare-metal, implementación de sistemas operativos, gestión de firmware y parches, configuración de hipervisores, desmantelamiento y procesos automatizados de diagnóstico y remediación utilizando Ansible, Python y pipelines CI/CD.
  • Definir y operar prácticas de confiabilidad para servicios de cómputo mediante la creación y mantenimiento de SLIs, SLOs y presupuestos de error, además de mejorar la observabilidad, reducir el ruido de monitoreo, realizar análisis post-incidente y transformar fallas recurrentes en soluciones automatizadas.
  • Colaborar con equipos de Ingeniería de Cómputo, Automatización de Plataformas y Observabilidad para definir requisitos operativos, integrar automatizaciones en la plataforma corporativa de IA y automatización, garantizar criterios de preparación operativa y contribuir a políticas como código orientadas a la operación segura y escalable de plataformas de cómputo.
  • Liderar iniciativas de mejora continua mediante la medición de la cobertura de automatización, el aumento de las tasas de resolución autónoma, el mantenimiento de bases de conocimiento estructuradas, la identificación de oportunidades para eliminar actividades manuales y la evaluación de nuevas herramientas para su integración en el ecosistema corporativo.
  • Participar en la guardia de la torre de Cómputo, actuando como punto de escalación cuando los mecanismos automatizados no resuelvan incidentes críticos dentro de los niveles de servicio definidos y utilizando información de diagnóstico previamente consolidada para acelerar la resolución.


Requisitos esenciales


  • Título universitario completo en Ciencias de la Computación, Tecnología de la Información, Ingeniería o áreas afines, con experiencia en SRE, Ingeniería de Infraestructura, Ingeniería de Servidores u Operaciones de Plataformas a gran escala.
  • Inglés avanzado o fluido, con capacidad para colaborar efectivamente con equipos globales.
  • Experiencia práctica avanzada en al menos dos de las siguientes áreas: VMware vSphere/vCenter, plataformas de servidores bare-metal (Dell PowerEdge, HPE, Cisco UCS o equivalentes), sistemas operativos Linux (Oracle Linux, RHEL o equivalentes) o entornos Windows Server.
  • Experiencia comprobada en el desarrollo de automatizaciones de infraestructura utilizando Ansible, Python, Git, pipelines CI/CD y prácticas de GitOps, incluyendo la gestión automatizada del ciclo de vida de plataformas de cómputo.
  • Conocimiento sólido en observabilidad, monitoreo de infraestructura, confiabilidad de sistemas, solución de problemas, gestión de incidentes, análisis de causa raíz y resolución de fallas complejas que involucren hardware, hipervisores, sistemas operativos y entornos distribuidos.


Requisitos deseables


  • Experiencia con vROps, Zabbix, Dynatrace, ServiceNow CMDB, NetBox, GitLab CI, herramientas de gestión de imágenes (Kickstart, Preseed, Packer), automatización de firmware, prácticas formales de Site Reliability Engineering (SRE) y entornos regulados por requisitos de cumplimiento como SOX, PCI-DSS o ISO 27001.
  • Familiaridad con plataformas corporativas de automatización asistida por IA, soluciones de IA agéntica, integración de LLMs en procesos operativos y ecosistemas avanzados de observabilidad y automatización empresarial.
Ver todas las vacantes de Dell Technologies | Radancy

Compartir vacante:

Compartir vacante: