Descrição
Resumo:
Liderar uma equipe de Engenharia de Confiabilidade de Sites (SRE) para garantir a confiabilidade, escalabilidade e excelência operacional da Plataforma em Nuvem Guidewire (GWCP) e dos produtos InsuranceSuite.
Pontos principais:
1. Liderar uma equipe de SRE de alto desempenho com liderança técnica prática.
2. Impulsionar padrões de confiabilidade, automação e melhoria contínua.
3. Fomentar uma cultura de propriedade, responsabilidade e orientação para serviços.
**Brasil \- Curitiba**
Desenvolvimento de Produtos e Operações/Período Integral/Híbrido
A Engenharia de Confiabilidade de Sites (SRE) combina engenharia de software e de sistemas para projetar e operar sistemas em larga escala, altamente distribuídos e tolerantes a falhas. Como Gerente de SRE na Guidewire, você liderará uma equipe responsável pela confiabilidade, escalabilidade e excelência operacional da Plataforma em Nuvem Guidewire (GWCP) e dos produtos InsuranceSuite.
Esta função combina liderança técnica prática com a liderança de pessoas que trabalham para você, assegurando que os sistemas operem com confiabilidade em escala, ao mesmo tempo em que se constrói uma equipe de SRE de alto desempenho. Você colaborará com equipes de engenharia, produto e plataforma para impulsionar padrões de confiabilidade, automação e melhoria contínua.
Para saber mais sobre a GWCP e seu modelo de locação, leia mais aqui:
https://medium.com/guidewire\-engineering\-blog/guidewire\-cloud\-why\-hybrid\-tenancy\-is\-the\-right\-choice\-part\-2\-of\-2\-ba22c9888bb8
Descrição da vaga
O que você fará
Liderança técnica \& execução
Fornecer direção técnica e supervisão para iniciativas de SRE, garantindo as melhores práticas em confiabilidade, escalabilidade e desempenho.
Manter-se envolvido tecnicamente quando necessário, contribuindo para o projeto de sistemas, automação e resolução de incidentes.
Orientar o projeto e desenvolvimento de ferramentas que suportem operações 24x7 seguindo o sol.
Impulsionar a automação no provisionamento de infraestrutura, implantações e fluxos operacionais.
Garantir estratégias eficazes de observabilidade (métricas, registros, rastreamento) e promover sistemas autorreparáveis.
Colaborar com equipes de engenharia para influenciar o projeto de sistemas quanto à confiabilidade e operabilidade.
Confiabilidade, engenharia de processos \& melhoria contínua
Projetar, evoluir e simplificar processos de SRE (gerenciamento de incidentes, prontidão para produção, planejamento de capacidade, gerenciamento de mudanças), com foco na eficácia, não na burocracia.
Aplicar princípios de engenharia de processos — assegurando que os processos sejam leves, escaláveis e capacitem as equipes, em vez de retardá-las.
Priorizar pessoas em vez de processos: usar processos como parâmetros orientadores, não como fluxos rígidos, e capacitar engenheiros a tomarem decisões sólidas.
Identificar proativamente lacunas, ineficiências e riscos — e conduzi-los até sua resolução com viés para a ação.
Estabelecer e aplicar SLOs, SLIs e orçamentos de erro em todos os serviços.
Liderar respostas a incidentes graves e garantir que as análises pós-incidente isentas de culpa resultem em melhorias reais e implementadas, não apenas em documentação.
Reduzir continuamente a carga operacional repetitiva por meio de automação e simplificação.
Assegurar que as operações seguindo o sol sejam práticas, sustentáveis e otimizadas para execução no mundo real.
Liderança de pessoas que trabalham para você
Contratar, integrar e desenvolver engenheiros de SRE.
Liderar as pessoas que trabalham para você estabelecendo expectativas claras, fornecendo orientação e removendo obstáculos à execução.
Fomentar uma cultura de propriedade, responsabilidade e orientação para serviços.
Apoiar os engenheiros na tomada de decisões e na ação, em vez de depender de processos rígidos ou escalonamentos.
Incentivar o pensamento crítico e a resolução de problemas, em vez de execução baseada em listas de verificação.
Equilibrar a carga de trabalho entre a equipe, assegurando participação sustentável em plantões e responsabilidades operacionais.
Definir prioridades claras e garantir que a equipe esteja concentrada em trabalhos de alto impacto que melhorem a confiabilidade e os resultados para os clientes.
Colaboração entre equipes \& mentalidade de serviço
Atuar como parte interessada fundamental nas equipes de Plataforma de SRE, Desenvolvimento de Produtos e Engenharia de Nuvem.
Demonstrar forte mentalidade de serviço — assegurando que as capacidades da plataforma atendam às necessidades das equipes internas e dos clientes.
Equilibrar padrões de plataforma com pragmatismo, capacitando equipes ao mesmo tempo em que mantém a confiabilidade e os parâmetros orientadores.
Colaborar com equipes para resolver problemas conjuntamente, em vez de agir como um controlador.
Impulsionar a adoção de boas práticas por meio de influência, não apenas por imposição.
Estratégia \& execução operacionais
Definir e acompanhar métricas que reflitam resultados reais (confiabilidade, impacto nos clientes, eficiência da equipe), não apenas aderência a processos.
Assegurar que o trabalho seja priorizado em direção a melhorias significativas em confiabilidade, escalabilidade e experiência do desenvolvedor.
Avaliar continuamente se processos, ferramentas e práticas estão gerando valor — e ajustá-los quando não estiverem.
Evitar sobrecarga desnecessária de processos; focar em capacitar equipes a avançarem com segurança e mais rapidamente.
Defender e impulsionar investimentos em melhorias de plataforma e iniciativas de confiabilidade.
Documentação \& compartilhamento de conhecimento
Assegurar documentação de alta qualidade, manuais operacionais e orientações operacionais.
Promover o compartilhamento de conhecimento entre equipes e regiões.
Capacitar equipes a operarem de forma independente por meio de documentação clara e ferramentas adequadas.
Quem você é
Expertise técnica
Fortes habilidades de programação em Python ou Go; experiência com Java/Spring Boot é um diferencial.
Experiência profunda com Kubernetes (EKS), incluindo rede, ingress e padrões de operadores.
Especialização em Terraform e infraestrutura como código em larga escala.
Conhecimento avançado de serviços AWS e arquitetura de sistemas distribuídos.
Fundo sólido em ferramentas de observabilidade, como Prometheus, OpenTelemetry ou Datadog.
Experiência em dar suporte a sistemas de produção em larga escala em um ambiente de microsserviços.
Familiaridade com sistemas de CI/CD, como TeamCity, GitHub Actions ou Jenkins.
Compreensão de SSO, SAML, OAuth; experiência com Okta é um diferencial.
Liderança \& senso de propriedade
Experiência comprovada liderando engenheiros que trabalham para você, mantendo credibilidade técnica.
Capacidade comprovada de construir e evoluir processos que sirvam às pessoas e aos resultados, não à burocracia.
Forte senso de propriedade, com histórico de conduzir questões até sua resolução.
Capacidade comprovada de identificar problemas, tomar iniciativa e implementar soluções sem esperar por instruções.
Habilidade de equilibrar necessidades operacionais de curto prazo com melhorias de longo prazo.
Conforto em tomar decisões e assumir responsabilidade em situações de alta pressão.
Colaboração \& comunicação
Excelentes habilidades de comunicação, com capacidade de influenciar diversas equipes.
Capacidade de traduzir conceitos técnicos complexos em insights claros e acionáveis.
Experiência em ambientes ágeis (Scrum, Kanban).
Mentalidade
Forte mentalidade orientada para serviços, com foco em capacitar os outros ao sucesso.
Viés para a ação e resolução de problemas, em vez de coordenação e escalonamento.
Foco em resultados, não em sobrecarga de processos.
Paixão por confiabilidade, automação e melhoria contínua.
Curiosidade e disposição para explorar tecnologias emergentes, incluindo IA, para melhorar produtividade e resultados.
Pontos extras
Certificações em Kubernetes ou AWS.
Experiência liderando equipes de SRE ou de plataforma.
Contribuições em projetos de código aberto.
Familiaridade com ferramentas como KubeVela (OAM) ou Crossplane.
Experiência na implementação de estruturas de SLO/orçamento de erro em larga escala.
Interessado nesta posição?
Sobre a Guidewire
A Guidewire é a plataforma em que seguradoras de danos e acidentes confiam para se envolverem, inovarem e crescerem com eficiência. Combinamos digital, núcleo, análise de dados e IA para entregar nossa plataforma como um serviço em nuvem. Mais de 540+ seguradoras em 40 países, desde novas empresas até as maiores e mais complexas do mundo, operam na Guidewire.
Como parceira de nossos clientes, evoluímos continuamente para possibilitar seu sucesso. Temos orgulho de nosso histórico incomparável de implementações, com mais de 1600 projetos bem-sucedidos, apoiados pela maior equipe de P\&D e ecossistema de parceiros da indústria. Nosso Marketplace oferece centenas de aplicações que aceleram integração, localização e inovação.
Para mais informações, visite www.guidewire.com e siga-nos no Twitter: @Guidewire\_PandC.
A Guidewire Software, Inc. tem orgulho de ser uma empregadora que oferece igualdade de oportunidades e ação afirmativa. Comprometemo-nos com um ambiente de trabalho inclusivo e acreditamos que a diversidade de perspectivas, habilidades e culturas é essencial para nosso sucesso. Candidatos qualificados serão considerados sem distinção de raça, cor, ascendência, religião, sexo, origem nacional, cidadania, estado civil, idade, orientação sexual, identidade de gênero, expressão de gênero, status de veterano ou deficiência. Todas as ofertas estão condicionadas à aprovação em verificações de antecedentes criminais e outras verificações de background, conforme aplicável à posição.