Marketing

\- Criatividade e proatividade; \- Boa comunicação; \- Conhecimento em redes sociais; \- Experiência com criação de conteúdo; \- Noções de design
- Create social media content
- Plan marketing campaigns
- Promotional art and text production

Estamos procurando um **Engenheiro-Chefe de Rede HPC** para definir a estratégia técnica global, a arquitetura de referência e a visão de engenharia por trás da infraestrutura avançada de IA, pesquisa e GPU baseada em Kubernetes para um importante cliente global de tecnologia. O cargo concentra-se no estabelecimento da direção técnica de longo prazo, na governança das decisões arquitetônicas em múltiplos programas e na definição de padrões de engenharia organizacionais para tecidos de rede de alto desempenho que suportam cargas de trabalho massivas de LLM e IA distribuída, incluindo InfiniBand/RDMA, Ethernet de alta velocidade, redes Kubernetes, redes GPU no lado do host, tecnologias SmartNIC/DPU e observabilidade profunda de rede. Como autoridade técnica principal, você modelará a cultura de engenharia, orientará engenheiros líderes e principais, influenciará as roadmaps executivas do cliente e será responsável pela governança ponta a ponta de plataformas de rede críticas para a missão em todo o portfólio. O candidato ideal combina experiência autoritária em InfiniBand NDR/HDR e tecidos de próxima geração, RDMA/RoCE, redes NVIDIA/Mellanox, padrões de comunicação NCCL/MSCCL, redes Linux no lado do host, topologia PCIe/GPU/NIC e redes Kubernetes para clusters GPU, com histórico comprovado de liderança de múltiplas equipes de engenharia, definição de estratégia técnica no nível do programa e modelagem de plataformas de rede HPC/IA líderes do setor. **Responsabilidades** * Definir e assumir a propriedade da visão estratégica plurianual e da roadmap arquitetônica para tecidos de alto desempenho InfiniBand/RDMA e Ethernet que impulsionam clusters GPU em larga escala e cargas de trabalho distribuídas de IA/LLM em todo o portfólio do cliente * Regular o projeto, avaliação e padronização de topologias de rede de cluster, incluindo Fat-tree, Clos, Rail-otimizadas e Dragonfly, e estabelecer frameworks de decisão empresariais alinhados às restrições de escala, desempenho e custo das cargas de trabalho * Estabelecer e aplicar padrões e boas práticas de engenharia organizacionais para redes no lado do host, incluindo configuração de NICs, drivers, firmware, afinidade de IRQ, posicionamento NUMA, topologia PCIe e caminhos de comunicação entre GPU e NIC * Definir a direção estratégica para engenharia de desempenho em RDMA/RoCE, NCCL/MSCCL e comunicação coletiva para cargas de trabalho de treinamento multi-nó GPU, e supervisionar a resolução dos problemas sistêmicos de desempenho mais complexos * Definir a arquitetura de referência canônica para redes Kubernetes em clusters GPU, incluindo plugins CNI, políticas de rede, pods multi-NIC, plugins de dispositivo RDMA/GPU e integração com orquestração de cargas de trabalho, e impulsionar sua adoção em múltiplos programas * Assumir a propriedade da estratégia e governança para tecnologias SmartNIC/DPU, como NVIDIA BlueField, incluindo casos de uso SR-IOV, offload, isolamento e segurança, e alinhar sua adoção com a roadmap mais ampla de infraestrutura * Definir a estratégia empresarial de observabilidade para plataformas de rede, regulando métricas, dashboards, alertas, detecção de congestionamento, rastreamento de latência, frameworks SLO e metodologias de análise de capacidade/desempenho * Oferecer liderança técnica e mentoria a engenheiros líderes e principais nas equipes de rede, Kubernetes, armazenamento, infraestrutura GPU, observabilidade e pesquisa em IA, construindo o pipeline de talentos e impulsionando o alinhamento multifuncional em larga escala * Atuar como autoridade técnica principal em fóruns executivos com o cliente e stakeholders, moldando a direção técnica estratégica, negociando trade-offs no nível do programa e garantindo a entrega de plataformas de rede confiáveis e escaláveis em múltiplos engajamentos * Contribuir para a comunidade de engenharia mais ampla por meio de liderança intelectual, desenvolvimento interno de práticas e representação da empresa em eventos do setor **Requisitos** * 8+ anos de experiência em funções de rede, infraestrutura, HPC, SRE ou áreas similares de engenharia, com 4+ anos focados em redes de HPC, IA/ML ou clusters GPU, incluindo liderança técnica comprovada no nível do programa ou portfólio (2+ anos) * Experiência comprovada na definição da arquitetura e governança da entrega de tecidos InfiniBand/RDMA, Ethernet de alta velocidade e redes Linux em ambientes de computação distribuída em larga escala e críticos quanto ao desempenho * Expertise autoritária em redes no lado do host, incluindo NICs, drivers e firmware, além de topologia PCIe, consciência NUMA e afinidade GPU-NIC, com capacidade comprovada de definir padrões empresariais e elevar organizações de engenharia * Profundo entendimento dos padrões de comunicação em treinamento distribuído de IA, incluindo cargas de trabalho baseadas em NCCL e operações coletivas como all-reduce e all-gather, com habilidade para conduzir estratégias de co-projeto carga de trabalho-rede em larga escala * Conhecimento autoritário de Kubernetes e redes de contêineres para cargas de trabalho GPU ou distribuídas, incluindo conceitos CNI, políticas de rede, padrões multi-NIC e integração de dispositivos RDMA/GPU, com experiência na definição de arquiteturas de referência * Domínio especializado em conceitos de rede RDMA, incluindo InfiniBand, RoCE/RoCEv2, padrões relacionados ao GPUDirect, comportamento de congestionamento e ajuste de desempenho em escala muito grande * Domínio avançado de redes Linux e solução de problemas no lado do host, incluindo afinidade de IRQ, MTU, offloads e diagnósticos de desempenho, com capacidade de definir metodologias diagnósticas para toda a organização de engenharia * Propriedade comprovada da estratégia empresarial de observabilidade e gerenciamento de desempenho de rede, incluindo telemetria, monitoramento de tráfego, detecção de congestionamento, análise de latência, SLOs, planejamento de capacidade e alertas/solução de problemas nas camadas L1-L4, tecido e RDMA * Excelentes habilidades de liderança, mentoria, gestão de stakeholders e comunicação executiva, com experiência comprovada em liderar múltiplas equipes de engenharia, influenciar decisões arquitetônicas de clientes no nível C e impulsionar consenso entre pesquisadores, stakeholders de plataforma e patrocinadores executivos * Proficiência avançada no idioma inglês (nível C1) **Desejável** * Experiência prática arquitetônica e estratégica com redes Azure, Ethernet e tecnologias GPGPU/GPU * Comando autoritário de Grafana, Prometheus e administração de redes, com experiência na definição de padrões de observabilidade em uma organização de engenharia * Capacidade comprovada de definir estratégia, governar e dimensionar práticas de Infraestrutura como Código em múltiplas equipes e programas * Proficiência em Python e scripts de shell UNIX para automação, ferramentas e aumento da produtividade de engenharia em toda a organização * Histórico de liderança intelectual por meio de palestras em conferências, publicações, patentes ou contribuições open-source no domínio de redes HPC/IA

João Silva
Indeed · HR