11649035 - Analytics Engineer Pleno - #85
Indexed description
Responsabilidades e atribuições
Atuará com Python e Spark para processamento de dados em larga escala, utilizando Airflow como ferramenta de orquestração. Será responsável por pipelines de extração e integração em AWS, operando em ambientes distribuídos com Kubernetes e EMR.
No armazenamento e camada analítica, trabalhará com SQL, S3 e Trino, apoiando a modelagem e consulta de dados analíticos. Também participará da definição e manutenção da infraestrutura de dados utilizando Terraform, apoiado por framework proprietário de Infraestrutura como Código (IaC).
O profissional irá colaborar com times de engenharia, analytics e negócio, atuando no tuning e otimização de jobs Spark, versionamento e padronização de pipelines, além de contribuir com boas práticas de observabilidade, governança e escalabilidade da plataforma.
Requisitos e qualificações
- Experiência sólida com desenvolvimento de pipelines de dados (ingestão, transformação e disponibilização).
- Conhecimento em Python para processamento de dados.
- Experiência com Spark para processamento em larga escala.
- Vivência com Airflow para orquestração de workflows.
- Experiência com serviços de dados na AWS, especialmente com S3 e EMR
- Experiência com ambientes distribuídos e conteinerização, utilizando Kubernetes.
- Domínio de SQL para modelagem e consulta de dados analíticos.
- Experiência com motores de consulta distribuída, como Trino.
- Conhecimento em Infraestrutura como Código (IaC), utilizando Terraform.
- Experiência com versionamento de código (Git).
- Vivência com otimização e tuning de jobs Spark.
- Conhecimento em boas práticas de governança, observabilidade e qualidade de dados.
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search