Engenheiro(a) de IA SR
TypeFull-time job
LocationBrazil
Posted8 hours ago
Você é movido(a) por tecnologia, dados e inovação? 🚀
Na , transformamos desafios complexos em soluções inteligentes. Somos uma empresa brasileira focada em Analytics, IA e transformação digital, ajudando organizações a tomar decisões mais estratégicas e gerar impacto real nos negócios.
Trabalhamos com diferentes setores do mercado, sempre combinando tecnologia de ponta, visão de negócio e execução ágil.
Se você quer construir soluções que fazem a diferença e crescer junto com um time de alta performance, seu lugar pode ser aqui.
👉 Vem para a e construa o futuro com a gente.
Projetar e implementar sistemas multiagente com orquestração de ferramentas, memória, roteamento e mecanismos de fallback;
Construir e otimizar pipelines de RAG: ingestão, chunking, estratégias de indexação, busca híbrida, reranking e avaliação de qualidade de recuperação;
Desenvolver APIs e serviços em Python (FastAPI) para expor capacidades de IA, com testes, versionamento e CI/CD;
Definir e implementar a camada de avaliação: datasets de referência, métricas de qualidade, regressão de prompts e testes automatizados antes de cada release;
Instrumentar observabilidade de LLM: tracing de execuções, tokens, custo por requisição, taxa de erro por ferramenta e latência por etapa;
Otimizar custo e desempenho: seleção de modelo por tarefa, ajuste de esforço de raciocínio, cache, batching e redução de contexto;
Integrar os agentes a sistemas legados e canais corporativos, tratando autenticação, limites de taxa, idempotência e reprocessamento.
Experiência comprovada em desenvolvimento Python em nível avançado: tipagem, async, estruturação de projeto, testes e boas práticas de engenharia;
Vivência real colocando aplicações de LLM em produção;
Domínio de frameworks de orquestração de agentes (LangGraph, LangChain, CrewAI, Semantic Kernel ou SDK proprietário equivalente);
Experiência prática com RAG de ponta a ponta e com bancos vetoriais ou motores de busca (Azure AI Search, OpenSearch, pgvector, Qdrant, Elasticsearch);
Sólido entendimento de engenharia de prompt aplicada, structured outputs, function calling e estratégias de controle de alucinação;
Experiência com pelo menos uma nuvem pública em produção, incluindo containers, serverless, mensageria e gestão de identidade e acesso;
Familiaridade com Docker, Git e pipelines de CI/CD;
Capacidade de comunicação técnica com clientes, incluindo apresentar decisões de arquitetura e defender trade offs.
Diferenciais
Valorizamos fortemente quem já construiu soluções de IA sobre a stack da AWS:
Amazon Bedrock: invocação de modelos, Knowledge Bases, Guardrails, Agents e escolha de modelo por caso de uso;
Amazon SageMaker: endpoints de inferência, hospedagem de modelos abertos e jobs de treino ou fine tuning;
Compute e orquestração: EKS, ECS/Fargate, Lambda e Step Functions para fluxos assíncronos e de longa duração;
Busca e dados: OpenSearch Service (incluindo busca vetorial e híbrida), S3, DynamoDB, Aurora PostgreSQL com pgvector;
Integração e eventos: API Gateway, SQS, SNS, EventBridge;
Governança e operação: IAM com privilégio mínimo, VPC e endpoints privados, Secrets Manager, KMS, CloudWatch e X-Ray para tracing.
Originally posted on Himalayas
Na , transformamos desafios complexos em soluções inteligentes. Somos uma empresa brasileira focada em Analytics, IA e transformação digital, ajudando organizações a tomar decisões mais estratégicas e gerar impacto real nos negócios.
Trabalhamos com diferentes setores do mercado, sempre combinando tecnologia de ponta, visão de negócio e execução ágil.
Se você quer construir soluções que fazem a diferença e crescer junto com um time de alta performance, seu lugar pode ser aqui.
👉 Vem para a e construa o futuro com a gente.
Projetar e implementar sistemas multiagente com orquestração de ferramentas, memória, roteamento e mecanismos de fallback;
Construir e otimizar pipelines de RAG: ingestão, chunking, estratégias de indexação, busca híbrida, reranking e avaliação de qualidade de recuperação;
Desenvolver APIs e serviços em Python (FastAPI) para expor capacidades de IA, com testes, versionamento e CI/CD;
Definir e implementar a camada de avaliação: datasets de referência, métricas de qualidade, regressão de prompts e testes automatizados antes de cada release;
Instrumentar observabilidade de LLM: tracing de execuções, tokens, custo por requisição, taxa de erro por ferramenta e latência por etapa;
Otimizar custo e desempenho: seleção de modelo por tarefa, ajuste de esforço de raciocínio, cache, batching e redução de contexto;
Integrar os agentes a sistemas legados e canais corporativos, tratando autenticação, limites de taxa, idempotência e reprocessamento.
Experiência comprovada em desenvolvimento Python em nível avançado: tipagem, async, estruturação de projeto, testes e boas práticas de engenharia;
Vivência real colocando aplicações de LLM em produção;
Domínio de frameworks de orquestração de agentes (LangGraph, LangChain, CrewAI, Semantic Kernel ou SDK proprietário equivalente);
Experiência prática com RAG de ponta a ponta e com bancos vetoriais ou motores de busca (Azure AI Search, OpenSearch, pgvector, Qdrant, Elasticsearch);
Sólido entendimento de engenharia de prompt aplicada, structured outputs, function calling e estratégias de controle de alucinação;
Experiência com pelo menos uma nuvem pública em produção, incluindo containers, serverless, mensageria e gestão de identidade e acesso;
Familiaridade com Docker, Git e pipelines de CI/CD;
Capacidade de comunicação técnica com clientes, incluindo apresentar decisões de arquitetura e defender trade offs.
Diferenciais
Valorizamos fortemente quem já construiu soluções de IA sobre a stack da AWS:
Amazon Bedrock: invocação de modelos, Knowledge Bases, Guardrails, Agents e escolha de modelo por caso de uso;
Amazon SageMaker: endpoints de inferência, hospedagem de modelos abertos e jobs de treino ou fine tuning;
Compute e orquestração: EKS, ECS/Fargate, Lambda e Step Functions para fluxos assíncronos e de longa duração;
Busca e dados: OpenSearch Service (incluindo busca vetorial e híbrida), S3, DynamoDB, Aurora PostgreSQL com pgvector;
Integração e eventos: API Gateway, SQS, SNS, EventBridge;
Governança e operação: IAM com privilégio mínimo, VPC e endpoints privados, Secrets Manager, KMS, CloudWatch e X-Ray para tracing.
Originally posted on Himalayas
Apply on Himalayas →
Job sourced from Himalayas. Applications happen directly on the original platform — we never collect your data.