Engenharia de IA GenAI | LLM EngineerGenAI | Remota 134497
Job Summary
Buscamos um(a) profissional para atuar na construção de produtos baseados em LLMs em ambiente produtivo trabalhando em conjunto com o(a) Arquiteto(a) de Soluções GenAI.
O profissional será responsável por transformar arquiteturas e definições técnicas em código robusto testado observável e pronto para produção atuando diretamente no desenvolvimento de soluções de Inteligência Artificial Generativa.
- Implementar pipelines de RAG (Retrieval-Augmented Generation);
- Desenvolver agentes utilizando frameworks como LangGraph;
- Construir chatbots e copilots baseados em LLMs;
- Integrar soluções de orquestração multi-modelo utilizando LiteLLM;
- Implementar recursos como:
- Function Calling;
- Memória para agentes;
- Orquestração de agentes;
- Integração com múltiplos modelos de linguagem.
- Desenvolver soluções full-stack utilizando:
- Python;
- .NET/C#;
- React/TypeScript;
- Construir APIs robustas com suporte a:
- Streaming;
- Processamento assíncrono;
- Integrações entre sistemas;
- Aplicar padrões de resiliência como:
- Circuit Breaker;
- Retry;
- Timeout;
- Atuar em soluções distribuídas e escaláveis.
- Desenvolver e executar testes automatizados;
- Implementar avaliações de qualidade de LLMs (LLM Evals);
- Apoiar testes de regressão de modelos e prompts;
- Implementar observabilidade de soluções de IA;
- Monitorar indicadores como:
- Consumo de tokens;
- Latência;
- Custos de inferência;
- Atuar na identificação e resolução de problemas em produção.
- Participar de Code Reviews;
- Contribuir para ADRs (Architecture Decision Records);
- Apoiar a construção de POCs e MVPs;
- Elaborar documentação técnica;
- Trabalhar em conjunto com o(a) Arquiteto(a) de Soluções GenAI e demais times técnicos.
- Experiência mínima de 4 anos em desenvolvimento de software;
- Experiência mínima de 1 ano trabalhando com LLMs em soluções além de POCs;
- Experiência prática com:
- LangChain;
- LangGraph;
- Implementação de soluções RAG;
- Conhecimento em Python;
- Experiência com pelo menos uma das tecnologias:
- .NET/C#;
- React/TypeScript;
- Experiência em desenvolvimento full-stack;
- Conhecimento em APIs REST;
- Experiência com mensageria e processamento assíncrono;
- Noções de sistemas distribuídos;
- Experiência com pelo menos um provedor de nuvem:
- Azure;
- AWS;
- GCP;
- Experiência com CI/CD;
- Conhecimento em Docker;
- Experiência com pelo menos um provedor de LLM:
- Azure OpenAI;
- Amazon Bedrock;
- Vertex AI/Gemini;
- Claude;
- Conhecimento de Prompt Engineering aplicado;
- Experiência com Git;
- Vivência em times ágeis.
- Experiência com bancos de dados vetoriais como:
- pgvector;
- Pinecone;
- Azure AI Search;
- Conhecimento em arquiteturas multiagente;
- Experiência com:
- CrewAI;
- AutoGen;
- Semantic Kernel;
- Conhecimento em MCP (Model Context Protocol);
- Experiência com observabilidade de LLMs:
- LangSmith;
- Arize;
- Conhecimento em frameworks de avaliação de LLMs:
- RAGAS;
- DeepEval;
- Experiência com:
- Guardrails;
- Proteção e tratamento de PII;
- Conhecimento em Kubernetes;
- Certificações em Cloud;
- Inglês avançado ou fluente com boa conversação.
Required Experience:
IC
About Company
We see opportunity in technology. In domains such as cloud, AI, mainframe modernisation, DLT and IoT, we blend established practice with new thinking to help our clients stay ahead.