Presencial
Campinas, SP, Brasil
Rango salarial
Empleado(a)
Nivel de experiencia
Nivel medio
Requisitos
Habilidades deseadas
Tareas y Responsabilidades
Show originalEn Nava, creemos en el poder de la tecnología para transformar negocios — y tenemos una oportunidad desafiante y estratégica esperándote.
¡Ven a crecer con nosotros!
Misión:
Monitorear la disponibilidad y el rendimiento de las aplicaciones e integraciones críticas, aislar la capa donde se manifiesta el incidente, ejecutar los procedimientos estandarizados de verificación y contención, y escalar al equipo de soporte o al área mantenedora con un diagnóstico y evidencias suficientes para acelerar la resolución.
Conocimientos esenciales:
Arquitectura de aplicaciones
- Modelos arquitectónicos y sus puntos de falla típicos: aplicación monolítica, arquitectura de tres capas, microservicios y aplicaciones heredadas (legacy).
- Flujo de una solicitud de extremo a extremo: cliente, balanceador, servidor web, servidor de aplicaciones, middleware, base de datos — y la capacidad de identificar en qué punto está fallando la solicitud.
- Conceptos de sesión, caché, pool de conexiones y timeout — y cómo cada uno se manifiesta como un síntoma para el usuario final.
- Diferencia práctica entre indisponibilidad total, degradación del rendimiento y falla funcional parcial, determinante para la clasificación correcta de la severidad.
- Entornos segregados (producción, homologación, desarrollo) y la disciplina de no confundir alertas de entornos no productivos con incidentes críticos.
- Nociones de alta disponibilidad y balanceo de carga: concepto de nodo fuera del balanceador, sesión atrapada y falla en failover.
Servidores web y servidores de aplicaciones
- Servidores web: Apache HTTP Server, NGINX y Microsoft IIS — verificación de estado, lectura de logs de acceso y de error.
- Interpretación de códigos de estado HTTP con razonamiento diagnóstico: distinguir errores del cliente (4xx) de errores del servidor (5xx), y reconocer 502, 503 y 504 como síntomas típicos de un backend no disponible, sobrecargado o lento.
- Servidores de aplicaciones: Apache Tomcat, JBoss/WildFly, WebLogic o WebSphere según el entorno — verificación de estado, uso de heap y lectura de logs.
- Nociones de JVM a nivel de síntoma: OutOfMemoryError, recolección de basura excesiva y hilos bloqueados — sin entrar en ajustes (tuning).
- Certificados digitales: identificación de la expiración del certificado como causa de indisponibilidad — una falla recurrente, predecible y evitable mediante monitoreo.
- Conceptos de proxy inverso y balanceador de carga, con verificación de nodos activos y health checks.
Middleware e integraciones
- Concepto de middleware como capa de integración y sus modos de falla: cola detenida, mensaje en error, conector desconectado, credencial expirada.
- Colas y mensajería: concepto de cola, tópico, dead letter queue y acumulación de mensajes como síntoma de un consumidor detenido.
- APIs REST y SOAP: lectura de respuestas, identificación de errores de autenticación, de payload y de timeout; uso de herramientas de prueba de endpoints para validación.
- Autenticación y autorización en integraciones: tokens, certificados, claves y el patrón de falla por expiración de credenciales.
- Procesamiento por lotes (batch): verificación de ejecución, identificación de jobs bloqueados o fuera de la ventana programada, e impacto en cascada sobre sistemas dependientes.
- Transferencia de archivos e interfaces basadas en archivos, aún frecuentes en entornos de servicios públicos (utilities).
Observabilidad aplicada a aplicaciones
- Dynatrace o equivalente a nivel de lectura: análisis de transacciones, identificación de servicios degradados y navegación en mapas de dependencia — una competencia de alto valor para aislar capas.
- Splunk o equivalente para búsqueda en logs centralizados y correlación de eventos entre componentes.
- Zabbix a nivel de lectura de ítems de aplicación, triggers e historial de disponibilidad.
- Conceptos de APM: tiempo de respuesta, tasa de error, throughput y Apdex — vocabulario necesario para comunicar la degradación de forma objetiva.
- Correlación temporal entre eventos de aplicación, infraestructura y cambios recientes — la primera pregunta en cualquier incidente de aplicación es: ¿qué cambió?
Deseables:
- Título universitario completo en TI o áreas afines.
- Experiencia previa en soporte a aplicaciones corporativas en entornos de misión crítica, preferiblemente con plataformas SAP.
- Certificación ITIL 4 Foundation.
- Certificación o capacitación formal en una herramienta de observabilidad (Dynatrace Associate, Splunk Core Certified User).
- Nociones de SQL para consultas de verificación guiadas por playbooks, en complemento al trabajo del analista de bases de datos.
- Nociones de scripting para ejecutar rutinas de verificación (PowerShell, Bash o Python).
- Inglés técnico para lectura de documentación de fabricantes y apertura de tickets con proveedores.
- Experiencia en el sector eléctrico o de servicios públicos (utilities), con comprensión del impacto regulatorio de las indisponibilidades.
Lo que no se espera de esta posición:
- Depuración de código, análisis profundo de stack traces o corrección de defectos de software.
- Deploy, rollback o cualquier cambio en el entorno de producción.
- Tuning de JVM, ajuste de pools de conexiones, dimensionamiento de heap o configuración del servidor de aplicaciones.
- Creación o modificación de integraciones, endpoints, colas o rutinas de batch.
- Reprocesamiento de mensajes en error o intervención en colas de producción sin un playbook aprobado.
- Soporte funcional al usuario sobre reglas de negocio de la aplicación — competencia del área mantenedora.
- Renovación o instalación de certificados digitales — la posición identifica la expiración y escala; la sustitución sigue el proceso de gestión de cambios.
¿Te interesó? Postúlate a la vacante y realiza tu entrevista técnica con SophIA:
https://entrevista.starmindai.ai
Código: NAVA-SUPORTEN15
Compartir vacante:
Compartir vacante: