Descrição
Resumo da Vaga:
Buscamos um profissional para apoiar na construção e manutenção de pipelines de dados, preparar datasets para GenAI e executar testes de prompts, contribuindo para a documentação técnica e organização.
Principais Destaques:
1. Apoio na construção e evolução de pipelines e fluxos de dados
2. Preparação de datasets e testes para modelos de GenAI
3. Foco em automação, MLOps e boas práticas de engenharia de dados
Descrição:
* Experiência prévia (mesmo que introdutória) com LangChain, LlamaIndex ou frameworks similares.
* Vivência em projetos acadêmicos, pessoais ou profissionais relacionados a GenAI.
* Noções de visualização de dados (Power BI, Tableau, Looker etc.).
* Interesse por automação, MLOps e boas práticas de engenharia de dados.
Formação Acadêmica:
* Graduação em andamento ou concluída em Ciência da Computação, Engenharia, Sistemas de Informação, Análise e Desenvolvimento de Sistemas ou áreas correlatas.
Responsabilidades e Atribuições:
* Apoiar na construção, manutenção e evolução de pipelines e fluxos de dados.
* Preparar datasets e inputs para testes de modelos e experimentos de GenAI.
* Executar testes de prompts, fluxos de interação e avaliações técnicas em PoCs.
* Criar relatórios para acompanhamento de performance e entregas.
* Contribuir para a documentação técnica, versionamento e organização das entregas.
Requisitos e Qualificações:
* Experiência inicial com Python e manipulação de dados.
* Familiaridade com conceitos de IA generativa e pipelines de dados.
* Noções sobre integração com bancos de dados (SQL e/ou NoSQL).
* Conhecimento básico sobre ambientes cloud (AWS de preferência).
* Boa comunicação e organização para apoiar entregas rápidas e bem documentadas.
* Facilidade para lidar com ferramentas de produtividade e colaboração.
2512100202181912064