Você é movido(a) por tecnologia, dados e inovação? 🚀Na Triggo.ai, transformamos desafios complexos em soluções inteligentes. Somos uma empresa brasileira focada em Analytics, IA e transformação digital, ajudando organizações a tomar decisões mais estratégicas e gerar impacto real nos negócios.Trabalhamos com diferentes setores do mercado, sempre combinando tecnologia de ponta, visão de negócio e execução ágil.Se você quer construir soluções que fazem a diferença e crescer junto com um time de alta performance, seu lugar pode ser aqui.👉 Vem para a Triggo.ai e construa o futuro com a gente.
Responsabilidades e atribuições
- Projetar e implementar sistemas multiagente com orquestração de ferramentas, memória, roteamento e mecanismos de fallback
- Construir e otimizar pipelines de RAG: ingestão, chunking, estratégias de indexação, busca híbrida, reranking e avaliação de qualidade de recuperação
- Desenvolver APIs e serviços em Python (FastAPI) para expor capacidades de IA, com testes, versionamento e CI/CD
- Definir e implementar a camada de avaliação: datasets de referência, métricas de qualidade, regressão de prompts e testes automatizados antes de cada release
- Instrumentar observabilidade de LLM: tracing de execuções, tokens, custo por requisição, taxa de erro por ferramenta e latência por etapa
- Otimizar custo e desempenho: seleção de modelo por tarefa, ajuste de esforço de raciocínio, cache, batching e redução de contexto
- Integrar os agentes a sistemas legados e canais corporativos, tratando autenticação, limites de taxa, idempotência e reprocessamento.
Requisitos e qualificações
- Experiência comprovada em desenvolvimento Python em nível avançado: tipagem, async, estruturação de projeto, testes e boas práticas de engenharia
- Vivência real colocando aplicações de LLM em produção
- Domínio de frameworks de orquestração de agentes (Lang
Graph, Lang
Chain, CrewAI, Semantic Kernel ou SDK proprietário equivalente);Experiência prática com RAG de ponta a ponta e com bancos vetoriais ou motores de busca (Azure AI Search, Open
- Search, pgvector, Qdrant, Elasticsearch)
- Sólido entendimento de engenharia de prompt aplicada, structured outputs, function calling e estratégias de controle de alucinação
- Experiência com pelo menos uma nuvem pública em produção, incluindo containers, serverless, mensageria e gestão de identidade e acesso
- Familiaridade com Docker, Git e pipelines de CI/CD
- Capacidade de comunicação técnica com clientes, incluindo apresentar decisões de arquitetura e defender trade offs.Diferenciais
Valorizamos fortemente quem já construiu soluções de IA sobre a stack da AWS:Amazon Bedrock: invocação de modelos, Knowledge Bases, Guardrails, Agents e escolha de modelo por caso de uso;Amazon Sage
- Maker: endpoints de inferência, hospedagem de modelos abertos e jobs de treino ou fine tuning
- Compute e orquestração: EKS, ECS/Fargate, Lambda e Step Functions para fluxos assíncronos e de longa duração
- Busca e dados: Open
Search Service (incluindo busca vetorial e híbrida), S3, DynamoDB, Aurora PostgreSQL com pgvector;Integração e eventos: API Gateway, SQS, SNS, Event
Bridge;Governança e operação: IAM com privilégio mínimo, VPC e endpoints privados, Secrets Manager, KMS, Cloud
Watch e X-Ray para tracing.