Sobre o cliente:
Uma das maiores e mais consolidadas house of brands de software do Brasil, com mais de 30 anos de história liderando a transformação digital no ecossistema B2B, SaaS e GovTech. Desenvolve ecossistemas tecnológicos de alta complexidade que impactam diretamente a modernização de setores vitais do país, desde a eficiência pública até grandes indústrias nacionais. Com milhares de organizações parceiras e investimento massivo em IA e Engenharia de Dados, oferece um ambiente ideal para quem busca resolver problemas de grande escala e valoriza o aprendizado contínuo.
Responsabilidades e atribuições
- Projetar, construir e evoluir arquiteturas de dados, data lakes e pipelines, garantindo escalabilidade, performance, confiabilidade e aderência às necessidades do produto.
- Desenvolver soluções de ingestão, transformação e processamento de dados, em ambientes batch e streaming, utilizando Databricks, Spark, SQL, Python e tecnologias de cloud.
- Estruturar e evoluir modelos, workflows e automações de dados, aplicando boas práticas de engenharia, governança, versionamento, segurança e Infraestrutura como Código.
- Garantir qualidade e observabilidade dos dados e pipelines, monitorando performance, latência, consistência e confiabilidade das soluções.
- Atuar como protagonista nas decisões técnicas, participando ativamente de trade-offs de arquitetura, avaliando impactos e definindo soluções que equilibrem qualidade técnica, velocidade, escalabilidade e necessidades do negócio.
- Ser referência técnica dentro da área, compartilhando conhecimento, apoiando decisões do time e exercendo papel-chave na construção de soluções de dados e IA que gerem impacto relevante para o negócio.
Requisitos e qualificações
- Experiência comprovada em engenharia de dados ou arquitetura de dados, com foco em data lakes.
- Domínio de Databricks (Delta Lake, Unity Catalog, jobs e pipelines) e de ferramentas de nuvem para dados, como AWS S3, Glue, Athena, Lake Formation, Azure Data Lake, GCP Storage/BigQuery.
- Experiência com dbt para modelagem, transformação e testes de dados.
- Conhecimento sólido em SQL avançado e programação em Python (preferencial) para automação e transformação de dados.
- Experiência com processamento distribuído (Apache Spark, Databricks, Flink ou similar).
- Experiência com Infraestrutura como Código (Terraform ou equivalente) aplicada a plataformas de dados.
- Entendimento de governança de dados, incluindo gestão de metadados, segurança, versionamento e qualidade de dados.
- Experiência com mensageria e streaming de eventos (Kafka ou equivalente).
- Experiência com orquestração de workflows (Airflow ou equivalente).
- Conhecimento de bancos vetoriais e geração de embeddings (pgvector ou similar) para suporte a soluções de IA.
- Experiência com observabilidade de pipelines de dados (métricas de latência, qualidade e paridade entre camadas).
Benefícios:
- Cartão ECXPAY no valor de R$ 500,00/Mês;
- Acesso a Wellhub;
- Convênio Zenklub - Psicólogo / Nutricionista / Coaching/ Terapia;
- 22 dias de descanso remunerado, após 12 meses;
- Parceria com curso de línguas "Time Load";
- Parceria com Clínica Bridges.