O Itaú é a marca mais valiosa do Brasil, a melhor empresa para trabalhar segundo o Great Place to Work e o maior banco da América Latina. Nós impactamos diariamente mais de 98 milhões de clientes em 18 países.
Somos feitos de pessoas e acreditamos que ter um time com pluralidade de origens, culturas, crenças, experiências, raças, deficiências, gêneros, orientações afetivo-sexuais e gerações ampliam as perspectivas e contribuem para um clima de respeito e valorização das diferenças.
Estamos buscando uma pessoa para a posição de Analista de Engenharia de Dados Sênior, que queira se desenvolver e aprender, compartilhar, colaborar e inovar, entregando valor para todos os nossos clientes.
Nessa função você vai:
Estamos em busca de um(a) Engenheiro(a) de Dados Sênior com sólida experiência em arquitetura distribuída, processamento de grandes volumes de dados com Spark/PySpark e profundo conhecimento do ecossistema de dados da AWS.
Você será uma das principais referências técnicas da comunidade de Crédito Imobiliário, atuando na construção e evolução de pipelines escaláveis, resilientes e governados. Procuramos alguém com forte mentalidade de engenharia, visão arquitetural, foco em performance e segurança, e experiência em ambientes orientados a dados como produto e princípios de Data Mesh.
Projetar, desenvolver e otimizar pipelines de dados em larga escala utilizando Apache Spark e PySpark.
Construir soluções de ingestão, transformação e disponibilização de dados em arquiteturas distribuídas na AWS.
Atuar com serviços como S3, Glue, Athena, Redshift, Lambda, Step Functions, EMR e Lake Formation.
Desenvolver e evoluir Data Products governados, interoperáveis e preparados para consumo em um modelo Data Mesh.
Participar de definições arquiteturais, revisões técnicas e disseminação de boas práticas de engenharia de dados.
Implementar práticas de CI/CD, versionamento de código e automação de infraestrutura utilizando ferramentas como Terraform, CDK ou CloudFormation.
Trabalhar em parceria com times de Engenharia de Analytics, Ciência de Dados, Negócio e Governança de Dados.
Contribuir para observabilidade, monitoramento, qualidade e confiabilidade dos pipelines.
Experiência sólida com Apache Spark, preferencialmente em ambientes distribuídos utilizando AWS Glue, EMR ou similares.
Domínio de PySpark para processamento e transformação de grandes volumes de dados.
Vivência prática com a stack de dados da AWS, incluindo S3, Glue, Athena, Redshift, Lake Formation, Lambda e serviços correlatos.
Conhecimento avançado em modelagem de dados para Data Lakes e Data Warehouses, incluindo particionamento, formatos colunares, compactação e gestão de schemas.
Experiência com orquestração de pipelines (Airflow, Step Functions ou equivalentes).
Proficiência em Python e SQL, aplicando boas práticas de desenvolvimento, testes e código limpo.
Experiência com monitoramento, observabilidade e troubleshooting de pipelines de dados.
Vivência com versionamento de código e integração contínua.
Ao se tornar um ituber você tem_
Conheça mais sobre nossa cultura: https://www.itau.com.br/relacoes-com-investidores/noticias/cultura-itubers-e-nosso-novo-conjunto-de-valores/
*Estimulamos candidaturas de pessoas com deficiência em todas as nossas posições, sendo assim, sinta-se à vontade para se candidatar em vagas sinalizadas como exclusivas ou não para pessoas com deficiência. Somos comprometidos com a inclusão e valorizamos a diversidade.
#VemProItaú #VemSerItuber