Descrição
A FUNÇÃO
Estamos procurando um Engenheiro Pleno de Plataforma / SRE capaz de liderar trabalhos complexos de infraestrutura, impulsionar a arquitetura de IaC e GitOps, e estabelecer os padrões para como automatizamos e operamos sistemas em escala. Você enfrentará desafios difíceis — isolamento multi-inquilino, infraestrutura de autoatendimento, engenharia de confiabilidade — e terá o escopo necessário para resolvê-los adequadamente.
Esta não é uma função de processamento de chamados. Profissionais seniores aqui identificam problemas antes mesmo de serem solicitados, tomam decisões arquitetônicas, orientam engenheiros e elevam o limite do que a plataforma é capaz de fazer.
O QUE VOCÊ FARÁ
* Liderar a arquitetura de IaC — projeto de módulos Terraform, gerenciamento de estado, padrões multi-conta e definição dos padrões com base nos quais o restante da equipe constrói
* Impulsionar o GitOps em escala — configuração do ArgoCD, padrões de entrega progressiva, fluxos de promoção e confiabilidade de implantação em múltiplos ambientes e inquilinos
* Projetar e operar infraestrutura Kubernetes multi-inquilino na AWS EKS — isolamento de inquilinos, alocação de cargas de trabalho, topologia de cluster e estratégia de escalabilidade de longo prazo
* Construir automação de infraestrutura de autoatendimento — pipelines de provisionamento, gerenciamento de configuração e capacidades de plataforma que as equipes de engenharia possam consumir sem intervenção manual
* Liderar o uso de ferramentas de codificação agente para trabalho com infraestrutura — estruturação de novos ambientes, geração e revisão de IaC, aceleração da automação e estabelecimento de padrões para a equipe
* Assumir a responsabilidade pela confiabilidade — definições de SLO, orçamentos de erro, qualidade na resposta a incidentes e ciclo de feedback que transforma incidentes em melhorias da plataforma
* Estabelecer padrões de observabilidade — cobertura de rastreamento, qualidade de alertas, ergonomia do plantão e cultura de runbooks
* Colaborar com segurança na arquitetura de zero confiança, gerenciamento de segredos em escala e reforço da infraestrutura
* Contribuir para a roadmap técnica e ajudar a equipe a priorizar o trabalho adequado
* Orientar engenheiros de nível intermediário — revisão de código, feedback sobre projetos e acompanhamento no plantão
O QUE BUSCAMOS
* 6+ anos em engenharia de plataforma, SRE ou infraestrutura — com tempo significativo operando sistemas de produção em escala
* Expertise profunda em IaC — você projeta arquiteturas Terraform, não apenas escreve módulos; você já gerenciou estados complexos e configurações multi-conta em produção
* Experiência sólida em GitOps — você compreende profundamente o gerenciamento declarativo de infraestrutura e possui opiniões bem fundamentadas sobre como fazê-lo bem
* Conhecimento avançado em Kubernetes — você já operou clusters em produção, lidou com modos reais de falha e entende o sistema ao nível do plano de controle
* Experiência sólida na AWS — rede, computação, IAM, armazenamento e design multi-conta
* Experiência com infraestrutura multi-inquilino — padrões de isolamento, mitigação de vizinhos barulhentos e gerenciamento do ciclo de vida de inquilinos
* Mentalidade voltada à automação desde o nível sênior — você projeta sistemas que eliminam categorias inteiras de trabalho manual, não apenas tarefas individuais
* Usuário ativo de ferramentas de codificação agente — você sabe como direcioná-las eficazmente, revisar criticamente sua saída e usá-las para multiplicar sua produtividade
* Histórico comprovado em engenharia de confiabilidade — SLOs definidos e medidos, pós-mortems realizados, melhorias mensuráveis implementadas
* Excelente comunicador — você consegue tornar decisões arquitetônicas compreensíveis tanto para engenheiros quanto para a liderança
DESEJÁVEL
* Experiência com Karpenter e gerenciamento do ciclo de vida de nós em produção
* Experiência em FinOps — atribuição de custos, planejamento de capacidade reservada e dimensionamento adequado de cargas de trabalho
* Familiaridade com infraestrutura de dados — armazenamento de objetos, pipelines CDC ou padrões de lakehouse
* Experiência em suporte a cargas de trabalho de inferência de IA/ML ou computação baseada em GPU em produção
* Experiência prévia em escalar infraestrutura de plataforma em uma startup em transição para requisitos de nível empresarial
O QUE NÃO ENCONTRARÁ AQUI
Uma equipe de plataforma que mantém o status quo. Estamos construindo ativamente — novos requisitos de escala, novos domínios arquitetônicos, novas capacidades de automação. Engenheiros seniores aqui moldam como a plataforma evolui, e as ferramentas disponíveis para isso são melhores do que nunca.
Tipo: Tempo integral, remoto
O horário de trabalho é no fuso horário PST