Chat rápido, melhores ofertas — Baixar

[Vaga - 29349] Desenvolvedor Sênior de Dados (AWS), Brasil

Indeed

Empresa

Tipo de empregoTempo Integral
Modalidade de TrabalhoRemoto
Nível de ExperiênciaMais de 10 Anos
Nível de EducaçãoSem Limite de Formação

Descrição

Somos especialistas em **transformação tecnológica**, unindo expertise humana com inteligência artificial para criar soluções tecnológicas escaláveis. Com mais de 8.000 colaboradores CI\&T espalhados pelo mundo, construímos parcerias com mais de 1.000 clientes ao longo de nossos 30 anos de história. Inteligência Artificial é nossa realidade. A CI\&T está expandindo suas capacidades de desenvolvimento de dados para apoiar uma **iniciativa de plataforma greenfield para um cliente líder no setor de agronegócio**. Este novo produto está sendo construído do zero para entregar análises agronômicas impulsionadas por IA com visualizações de mapas georreferenciados — e a qualidade de sua base de dados determinará tudo o que virá a seguir. Esta posição está no cerne dessa base. Como **Desenvolvedor Sênior de Dados**, você trabalhará ao lado da liderança técnica do cliente para arquitetar e construir o ecossistema de dados que alimentará insights agronômicos inteligentes. Seu trabalho permitirá diretamente que aplicações de IA e visualizações geoespaciais funcionem com dados confiáveis e bem estruturados — tornando esta posição tanto tecnicamente exigente quanto estrategicamente crítica. Se você se destaca em ambientes ambíguos e de alta autonomia, onde molda a arquitetura de dados em vez de simplesmente herdá-la, esta é a sua vaga. ### **Responsabilidades** * **Projetar e construir pipelines de dados ponta a ponta** nas camadas RAW, Silver e Gold da Arquitetura Medallion, garantindo confiabilidade, desempenho e manutenibilidade em cada etapa * **Arquitetar processos de ingestão, transformação, padronização e disponibilização de dados**, estruturando fluxos de dados provenientes de fontes diversas e heterogêneas em uma base analítica coerente * **Modelar dados para consumo analítico** seguindo as melhores práticas de Data Warehouse, incluindo design em Star Schema e modelagem dimensional adequada para business intelligence e prontidão para IA * **Identificar, avaliar e consolidar novas fontes de dados** relevantes para os objetivos de negócios agronômicos, envolvendo proativamente stakeholders para compreender, obter e validar a disponibilidade e qualidade dos dados * **Interagir com stakeholders de negócios e liderança do cliente** para traduzir requisitos de domínio em decisões de arquitetura de dados, questionando suposições e propondo soluções fundamentadas em evidências técnicas * **Manipular, otimizar e disponibilizar dados em múltiplos formatos** — incluindo Parquet, CSV e conjuntos de dados geoespaciais — adaptados às necessidades de consumo de aplicações de IA downstream e visualizações baseadas em mapas * **Gerenciar e configurar infraestrutura em nuvem** ponta a ponta, incluindo armazenamento, computação, controle de acesso, funções serverless, catalogação de dados e processamento orientado a eventos na AWS * **Assumir a responsabilidade por práticas de implantação e CI/CD** para pipelines de dados — incluindo gerenciamento de repositórios, estratégia de ramificação, gates de teste e fluxos automatizados de implantação via GitLab * **Apoiar a criação da camada de dados que alimentará aplicações de IA/ML**, garantindo que qualidade, estrutura e disponibilidade dos dados atendam aos requisitos dos fluxos de machine learning — sem desenvolver diretamente os modelos em si * **Atuar como parceiro técnico proativo** em um ambiente greenfield: questionar, propor, experimentar e iterar com a equipe, em vez de executar isoladamente ### **Requisitos** * **Proficiência em inglês nível B2 ou superior** — capacidade de explicar fluxos técnicos, participar de discussões, fazer perguntas esclarecedoras e colaborar efetivamente com stakeholders internacionais (sotaque não é barreira; clareza na comunicação é essencial) * **Experiência sólida e prática com AWS**, abrangendo todo o espectro de infraestrutura: S3, IAM (permissões e configuração de segurança), Redshift, Lambda (casos de uso serverless) e Glue (incluindo Glue Catalog para gerenciamento de metadados); capacidade de avaliar trade-offs entre serviços para diferentes cenários de pipeline * **Experiência com Terraform ou ferramenta equivalente de Infrastructure-as-Code (IaC)**, aplicada recorrentemente em projetos reais de engenharia de dados — não apenas conhecimento teórico * **Proficiência com GitLab** para controle de versão, configuração de pipelines de CI/CD, fluxos de implantação e gerenciamento de gates de teste — especificamente GitLab, não apenas experiência genérica com Git * **Excelente domínio de SQL**, incluindo escrita de consultas complexas, transformações analíticas e ajuste de desempenho em ambientes de data warehouse * **Excelente domínio de PySpark**, aplicado ao processamento distribuído em larga escala — incluindo estratégias de particionamento (por exemplo, por dia/mês/ano), tratamento de volumes (dezenas a centenas de GB) e otimização de desempenho * **Experiência com Databricks**, utilizada no contexto de pipelines de engenharia de dados e arquiteturas lakehouse, incluindo cenários de migração e implantação * **Especialização em modelagem analítica de dados**, com sólido conhecimento de Star Schema e modelagem dimensional aplicada a ambientes de data warehousing e business intelligence * **Experiência prática com a Arquitetura Medallion** (camadas RAW / Silver / Gold), incluindo manipulação e otimização de arquivos Parquet e CSV * **Experiência integrando e consolidando dados de múltiplas fontes heterogêneas**, garantindo consistência, rastreabilidade e prontidão analítica * **Mentalidade adequada para projetos greenfield**: pró-ativa, orientada a soluções, confortável com ambiguidade e capaz de contribuir para decisões arquiteturais — não apenas executar tarefas pré-definidas ### **Desejável** * **Familiaridade com SnapLogic ou plataformas equivalentes de orquestração ETL low-code/no-code** (por exemplo, Pentaho, Airflow, Alteryx) — o SnapLogic é o padrão atual do cliente, com migração em andamento; experiência prática com lógica ETL baseada em blocos/fluxos é um diferencial * Experiência em processamento de dados geoespaciais e ambientes analíticos focados em visualizações baseadas em mapas e geográficas * Conhecimento de DuckDB para consultas analíticas in-process * Experiência em projetos de dados aplicados ao agronegócio ou agricultura de precisão * Exposição a fluxos de modelagem preditiva (por exemplo, gradient boosting, métodos ensemble ou similares) — como fornecedor de dados para pipelines de ML, não como desenvolvedor de modelos \#LI\-JP3 **Nossos benefícios:*** Plano de saúde e odontológico * Auxílio-refeição e auxílio-alimentação * Auxílio-creche * Licença paternidade estendida * Parceria com academias e profissionais de saúde e bem-estar por meio da Wellhub (Gympass) TotalPass; * Participação nos Lucros e Resultados (PLR); * Seguro de vida * Plataforma de aprendizagem contínua (Universidade CI\&T); * Clube de descontos * Plataforma online gratuita dedicada ao bem-estar físico, mental e integral * Curso de gravidez e parentalidade responsável * Parcerias com plataformas de aprendizagem online * Plataforma de aprendizagem de idiomas E muitos mais! Mais detalhes sobre nossos benefícios aqui: https://ciandt.com/br/pt\-br/carreiras Na CI\&T, inclusão começa no primeiro contato. Se você é pessoa com deficiência, é importante **apresentar seu laudo durante o processo seletivo.** *Veja quais dados devem constar no laudo clicando aqui*.Desta forma, podemos garantir o suporte e as adaptações que você merece. **Se você ainda não tem o laudo, não se preocupe: podemos apoiá-lo na obtenção dele.** Contamos com uma equipe dedicada de Saúde e Bem-Estar, especialistas em inclusão e grupos de afinidade que estarão com você em todas as etapas. Conte conosco para fazer essa jornada lado a lado.

Alguns conteúdos foram traduzidos automaticamente pelo sistema

Publicado por

João Silva

Indeed · HR

Localização

João Silva

Indeed · HR

Vagas semelhantes

[Vaga - 29349] Desenvolvedor Sênior de Dados (AWS), Brasil vaga da Indeed em 2026 | ok.com