Salary
Not listed
Posted
1d ago
Source
himalayas
Você é movido(a) por tecnologia, dados e inovação? 🚀
Na , transformamos desafios complexos em soluções inteligentes. Somos uma empresa brasileira focada em Analytics, IA e transformação digital, ajudando organizações a tomar decisões mais estratégicas e gerar impacto real nos negócios.
Trabalhamos com diferentes setores do mercado, sempre combinando tecnologia de ponta, visão de negócio e execução ágil.
Se você quer construir soluções que fazem a diferença e crescer junto com um time de alta performance, seu lugar pode ser aqui.
👉 Vem para a e construa o futuro com a gente.
- Projetar e implementar sistemas multiagente com orquestração de ferramentas, memória, roteamento e mecanismos de fallback;
- Construir e otimizar pipelines de RAG: ingestão, chunking, estratégias de indexação, busca híbrida, reranking e avaliação de qualidade de recuperação;
- Desenvolver APIs e serviços em Python (FastAPI) para expor capacidades de IA, com testes, versionamento e CI/CD;
- Definir e implementar a camada de avaliação: datasets de referência, métricas de qualidade, regressão de prompts e testes automatizados antes de cada release;
- Instrumentar observabilidade de LLM: tracing de execuções, tokens, custo por requisição, taxa de erro por ferramenta e latência por etapa;
- Otimizar custo e desempenho: seleção de modelo por tarefa, ajuste de esforço de raciocínio, cache, batching e redução de contexto;
- Integrar os agentes a sistemas legados e canais corporativos, tratando autenticação, limites de taxa, idempotência e reprocessamento.
- Experiência comprovada em desenvolvimento Python em nível avançado: tipagem, async, estruturação de projeto, testes e boas práticas de engenharia;
- Vivência real colocando aplicações de LLM em produção;
- Domínio de frameworks de orquestração de agentes (LangGraph, LangChain, CrewAI, Semantic Kernel ou SDK proprietário equivalente);
- Experiência prática com RAG de ponta a ponta e com bancos vetoriais ou motores de busca (Azure AI Search, OpenSearch, pgvector, Qdrant, Elasticsearch);
- Sólido entendimento de engenharia de prompt aplicada, structured outputs, function calling e estratégias de controle de alucinação;
- Experiência com pelo menos uma nuvem pública em produção, incluindo containers, serverless, mensageria e gestão de identidade e acesso;
- Familiaridade com Docker, Git e pipelines de CI/CD;
- Capacidade de comunicação técnica com clientes, incluindo apresentar decisões de arquitetura e defender trade offs.
Diferenciais
Valorizamos fortemente quem já construiu soluções de IA sobre a stack da AWS:
- Amazon Bedrock: invocação de modelos, Knowledge Bases, Guardrails, Agents e escolha de modelo por caso de uso;
- Amazon SageMaker: endpoints de inferência, hospedagem de modelos abertos e jobs de treino ou fine tuning;
- Compute e orquestração: EKS, ECS/Fargate, Lambda e Step Functions para fluxos assíncronos e de longa duração;
- Busca e dados: OpenSearch Service (incluindo busca vetorial e híbrida), S3, DynamoDB, Aurora PostgreSQL com pgvector;
- Integração e eventos: API Gateway, SQS, SNS, EventBridge;
- Governança e operação: IAM com privilégio mínimo, VPC e endpoints privados, Secrets Manager, KMS, CloudWatch e X-Ray para tracing.
Before you apply
- Confirm async-friendly culture vs daily standup-heavy expectations
- Ask about on-call rotation and incident expectations
- Check the tech stack matches what you actually want to use day-to-day
Interested in this role?
RemoteTide sends you directly to the source. No account required.