Descrição
Resumo da Vaga:
Você será responsável por implementar, configurar e administrar soluções de observabilidade utilizando Datadog, monitorando ambientes críticos e propondo melhorias contínuas.
Principais Destaques:
1. Implementação e gestão de soluções de observabilidade com Datadog
2. Criação de dashboards e monitoramento proativo de ambientes críticos
3. Análise de performance, troubleshooting e automação de observabilidade
Permanent Regular
Job Description:
Pluxee is a global player in employee benefits and engagement that operates in 31 countries. Pluxee helps companies attract, engage, and retain talent thanks to a broad range of solutions across Meal \& Food, Wellbeing, Lifestyle, Reward \& Recognition, and Public Benefits.
Powered by leading technology and more than 5,000 engaged team members, Pluxee acts as a trusted partner within a highly interconnected B2B2C ecosystem made up of more than 500,000 clients, 36 million consumers and 1\.7 million merchants.
Conducting its business as a trusted partner for more than 45 years, Pluxee is committed to creating a positive impact on all its stakeholders, from driving business to local communities, to supporting wellbeing at work for employees while protecting the planet.
Você será responsável por implementar, configurar e administrar soluções de observabilidade utilizando Datadog.
**Responsabilidades e Atribuições:**
* Criar e manter dashboards executivos, operacionais e técnicos para monitoramento de ambientes críticos;
* Desenvolver e ajustar alertas inteligentes, reduzindo falsos positivos e aumentando a efetividade operacional;
* Monitorar aplicações, infraestrutura e serviços em ambientes cloud e híbridos;
* Atuar na análise de logs, métricas e traces para troubleshooting e identificação de gargalos de performance;
* Apoiar times de desenvolvimento, operações e SRE na investigação e resolução de incidentes críticos;
* Implementar monitoramento em ambientes Kubernetes, containers Docker e arquiteturas de microserviços;
* Automatizar processos de observabilidade e provisionamento utilizando ferramentas como Terraform e Ansible;
* Conduzir análises de causa raiz (RCA) e apoiar processos de post\-mortem;
* Propor melhorias contínuas em disponibilidade, confiabilidade e experiência do usuário;
* Integrar o Datadog com ferramentas corporativas, pipelines CI/CD e plataformas cloud;
* Definir e acompanhar indicadores de disponibilidade, SLI, SLO e SLA;
* Participar de operações assistidas, war rooms e acompanhamento de eventos críticos do negócio;
* Documentar processos, padrões de monitoramento e boas práticas de observabilidade.
**Principais competências:**
* Implementação e gestão do Datadog (APM, Logs, Metrics, RUM, Synthetic Monitoring);
* Criação de dashboards e monitoramento proativo;
* Troubleshooting e análise de performance;
* Integração com AWS, Azure, GCP;
* Kubernetes e Docker;
* CI/CD e automação (Terraform, Ansible, etc.);
* Práticas de SRE e observabilidade;
* Formação superior completa: em Ciência da Computação, Engenharia de Computação,Engenharia de Software, Sistemas de Informação, Análise e Desenvolvimento de Sistemas ou áreas correlatas.
* Inglês técnico: desejável.
**Diferenciais:**
* Certificações em cloud (AWS, Azure, GCP)
* Experiência com ferramentas complementares (Prometheus, Grafana, ELK Stack)
* Conhecimento em segurança e monitoramento de compliance
**Informações adicionais**
--------------------------
Nossos benefícios são um diferencial do mercado :
* Refeição Pass
* Alimentação Pass
* Assistências médica e odontológica
* Seguro de vida
* Cultura Pass
* Wellhub
* Apoio Pass
* VT
* Subsídio de 50% do valor de medicamentos