Geekhunter Logo

Soluções

Software de recrutamento

Divulgue vagas, importe perfis, pré-qualifique candidatos com perguntas personalizadas e controle todo o recrutamento em um só lugar.

Serviço de recrutamento

Confie em nós para encontrar seu talento tech. Com o nosso time especializado atuamos nas principais etapas de recrutamento.

Base de talentos

Os melhores talentos tech do Brasil, todos pré-selecionados e prontos para novas oportunidades.

Nossos planos

Descubra o plano perfeito para suas necessidades.

Login

Português

PT

Randstad


São Paulo, SP, Brasil

Engenheiro de dados Pleno

Remoto

(Qualquer lugar)

Faixa de Remuneração

Não informada

Nível de Experiência

Pleno

Requisitos

3+ anos de experiência na carreira
SQL
Databricks
Python

Tarefas e Responsabilidades

Missão do Cargo: Executar e sustentar pipelines de dados e machine learning (ML), garantindo a qualidade, a organização e a disponibilidade das bases para consumo analítico das demais frentes da empresa.


Principais Atividades

  • Construir e manter pipelines no Databricks utilizando Delta Lake, Workflows e Jobs.
  • Desenvolver rotinas de ingestão e transformação de dados de diversas origens.
  • Preparar datasets estruturados para consumo em ferramentas parceiras e de BI (Emblem, Power BI, Tableau, Radar).
  • Apoiar a criação e a manutenção da Feature Store de dados para suporte às frentes de modelagem.
  • Operar pipelines de Machine Learning com suporte do MLflow.
  • Implementar verificações básicas de qualidade e integridade de dados.
  • Monitorar a execução diária de jobs e atuar preventivamente ou reativamente em casos de falhas.
  • Garantir o correto versionamento, documentação e organização do código-fonte.

Requisitos Técnicos e Formação Acadêmica

  • Formação: Ensino superior completo em áreas quantitativas como Estatística, Matemática, Engenharia, Ciência da Computação ou afins.
  • Experiência prática de trabalho com Databricks, Apache Spark e linguagem SQL.
  • Sólidos conhecimentos em programação Python voltada para manipulação de dados.
  • Experiência no desenvolvimento e manutenção de pipelines de dados (ETL/ELT).
  • Noções de conceitos de MLOps e de ferramentas de orquestração de fluxos (como Airflow ou similares).
  • Conhecimento básico sobre boas práticas de governança e qualidade de dados.

Perfil Comportamental

  • Forte senso de organização e extrema atenção aos detalhes.
  • Boa comunicação interpessoal para colaborar com times multidisciplinares.
  • Proatividade operacional para identificação e correção ágil de falhas.
  • Vontade constante de aprender e de se atualizar com novas tecnologias de dados.

Compartilhar vaga:

Compartilhar vaga: