
Engenheiro(a) de Dados Pleno
Publicada 20 de Agosto
Buscamos um(a) Engenheiro(a) de Dados Pleno para atuar no desenvolvimento, manutenção e evolução de soluções de dados, garantindo a qualidade, disponibilidade, segurança e confiabilidade das informações utilizadas pelas áreas de negócio.
O profissional terá atuação na construção de pipelines, integração e transformação de dados, modelagem, monitoramento e otimização dos processos, trabalhando em parceria com os times de Produto, Tecnologia e Negócios.
Principais responsabilidades:
- Desenvolver e manter pipelines de dados batch e incrementais;
- Integrar dados provenientes de APIs, bancos de dados, arquivos e sistemas de terceiros;
- Modelar e organizar dados em diferentes camadas;
- Construir processos de ETL/ELT utilizando Python, SQL e ferramentas de orquestração;
- Garantir qualidade, integridade, rastreabilidade e disponibilidade dos dados;
- Implementar mecanismos de idempotência, retries, backfill e tratamento de falhas;
- Criar testes e regras para validação e qualidade dos dados;
- Monitorar pipelines, investigar incidentes e atuar na análise de causa-raiz;
- Otimizar consultas, armazenamento, particionamento e custos de processamento;
- Documentar pipelines, tabelas, regras de negócio e fluxos de dados;
- Trabalhar em conjunto com os times de Produto, Tecnologia e Negócios das empresas do grupo;
- Aplicar práticas de segurança, controle de acesso e proteção de dados, em conformidade com a LGPD;
- Participar de revisões de código e contribuir para a evolução dos padrões técnicos da equipe.
Requisitos minimos:
- Graduação em Ciência da Computação, Engenharia de Software, Sistemas de Informação, Engenharia, Estatística, Ciência de Dados ou áreas correlatas.
- Experiência profissional em Engenharia de Dados ou desenvolvimento de soluções orientadas a dados;
- Domínio de SQL, incluindo joins, funções de janela e otimização de consultas;
- Experiência com Python aplicado à integração, transformação e processamento de dados;
- Conhecimento em processos de ETL/ELT e arquitetura de pipelines;
- Experiência com bancos de dados relacionais;
- Conhecimento em modelagem de dados analítica e transacional;
- Experiência com APIs REST e arquivos nos formatos JSON, CSV e Parquet;
- Conhecimento de Git, testes automatizados e boas práticas de desenvolvimento;
- Capacidade de diagnosticar falhas e trabalhar com logs e monitoramento;
- Boa comunicação e capacidade de traduzir regras de negócio em soluções de dados.
Será um diferencial:
- Experiência com AWS, especialmente S3, Glue, Athena, SageMaker, Lambda, IAM e CloudWatch, ou outras plataformas de cloud;
- Experiência com Apache Airflow ou ferramentas de orquestração equivalentes;
- Conhecimento de Spark ou PySpark;
- Experiência com Data Lake, Data Warehouse ou arquiteturas Lakehouse;
- Conhecimento de ferramentas de transformação de dados;
- Conhecimento de infraestrutura como código, utilizando Terraform ou ferramentas similares;
- Familiaridade com observabilidade, catálogo, linhagem e governança de dados.
Vaga 100% presencial para Foz do Iguaçu/PR, disponível também para pessoas com deficiência.