Engenheiro(a) de IA – IA Generativa e Agentes

Vaga não está no LinkedIn

🔥 12 minutos atrás

🌐 Argentina, República Dominicana, +4 outros países – Remoto

infoinfo

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🗣️ Engenheiro de LLM

👻 Score fantasma 11%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Azumo

Azumo

51 - 200 funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Consulting • Healthcare • Logistics

Azumo é uma empresa líder em desenvolvimento de software especializada em serviços nearshore. A empresa oferece um conjunto de soluções, incluindo desenvolvimento de software, equipes dedicadas, staff augmentation e serviços de CTO virtual. A Azumo é particularmente conhecida por sua expertise em Inteligência Artificial (IA), desenvolvimento de aplicativos móveis, engenharia de dados e serviços em nuvem (cloud). A empresa orgulha-se de entregar soluções de software de alta qualidade, escaláveis e inovadoras, sob medida para as necessidades específicas de diferentes setores, incluindo fintech, desenvolvimento de jogos, saúde e mídia. Com foco em reunir desenvolvedores talentosos da América Latina, a Azumo garante alinhamento de fuso horário e comunicação fluida com clientes na América do Norte. Seu compromisso com a qualidade e a satisfação do cliente é evidenciado por inúmeros prêmios e depoimentos positivos de organizações de prestígio como Facebook, Twitter e Discovery Channel.

Descrição

• Desenvolver sistemas de recuperação de informações com pipelines de chunking e embeddings, busca híbrida, reranking e avaliação da qualidade da recuperação • Desenvolver workflows agentivos, stateful e compostos por várias etapas, com chamadas de ferramentas, servidores MCP, imposição de saídas estruturadas, gerenciamento da janela de contexto, fallbacks determinísticos e etapas de aprovação com human-in-the-loop • Criar conjuntos de testes para avaliação, scoring realizado por model-as-judge, acompanhamento de regressões e análises de erros • Implementar defesa contra prompt injection, validação de saídas, guardrails, tratamento de PII e degradação controlada • Implantar sistemas containerizados no Azure ou AWS com CI/CD e observabilidade • Gerenciar os limites de latência, custos, tokens e throughput • Trabalhar nos repositórios e ambientes dos clientes, incluindo daily stand-ups e chamadas ocasionais com clientes • Desenvolver sistemas de IA em produção confiáveis, mensuráveis e acessíveis para usuários reais

🎯 Requisitos

• Mais de 4 anos desenvolvendo e entregando software em produção, com uma linguagem moderna de backend (por exemplo, Python) como principal foco • Experiência com testes, code review, CI/CD, Git, containers, design de APIs e programação assíncrona • Experiência em produção com sistemas baseados em LLMs, incluindo retrieval-augmented generation (RAG), function calling e tool calling, imposição de saídas estruturadas e design de prompts • Experiência prática com pgvector, Pinecone, Qdrant, FAISS ou Azure AI Search • Experiência com LangGraph, LangChain, CrewAI, MCP ou loops nativos de execução em Python • Experiência na criação de uma suíte de avaliação para um sistema baseado em LLM, incluindo design de conjuntos de testes, scoring por model-as-judge ou equivalente e acompanhamento de regressões • Experiência de implantação em cloud com Azure ou AWS, Docker, pipelines de CI/CD e infraestrutura como código, como GitHub Actions, Terraform ou Bicep • Capacidade de explicar os trade-offs de latência, custo de tokens e throughput • Uso ativo de Claude Code, Cursor ou GitHub Copilot em entregas reais • Inglês escrito e falado claro, nível C1 ou superior • Bacharelado em Ciência da Computação, Ciência de Dados ou área relacionada, ou experiência profissional equivalente • Diferenciais: fine-tuning com LoRA, QLoRA e PEFT; inferência self-hosted ou com modelos de pesos abertos; sistemas multimodais; segurança de LLMs; entregas em conformidade com SOC 2 ou HIPAA; inferência em streaming ou de alto throughput; contribuições para projetos de IA open source ou produção de conteúdo técnico

🏖️ Benefícios

• Cultura 100% remote-first (trabalho de qualquer lugar da América Latina) • Licença remunerada (PTO) • Feriados dos Estados Unidos • Treinamentos e certificações em IA • Desenvolvimento de carreira com mentoria • Participação nos lucros • Remuneração em dólares americanos

Candidatar-se

Vagas Similares

🕒 Junho 23

Workana

51 - 200

👥 RH Tech

🏪 Marketplace

🎯 Recrutamento

Senior AI Engineer focusing on Generative AI initiatives for a U.S.-based insurance company. Remote position supporting scalable AI applications in alignment with U.S. business hours.

🇦🇷 Argentina – Remoto

💰 Series C em 2024-02

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🗣️ Engenheiro de LLM

🗣️🇺🇸🇬🇧 Inglês obrigatório

🗣️🇪🇸 Espanhol obrigatório