Membro da Equipe Técnica, Inferência

🔥 0 minutos atrás

🌏 Qualquer lugar do mundo

⏰ Tempo Integral

🔴 Especialista

🖥 Engenheiro de Software

👻 Score fantasma 13%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Inferact

Inferact

11 - 50 funcionários

Fundada em 2025

🤖 Inteligência Artificial

🤝 B2B

🏢 Corporativo

Artificial Intelligence • B2B • Enterprise

A Inferact é uma startup fundada pelos criadores e mantenedores principais do vLLM, o principal motor de inferência de LLM de código aberto. A empresa tem como objetivo acelerar o progresso da inteligência artificial, tornando a inferência de modelos mais barata e rápida, ampliando o desempenho do vLLM e o suporte para arquiteturas emergentes e hardware acelerador. A Inferact combina uma profunda experiência na interseção de modelos e hardware para fornecer infraestrutura de inferência utilizada por laboratórios de pesquisa, hyperscalers e startups, enquanto continua a desenvolver e contribuir com otimizações para a comunidade de código aberto.

Descrição

• Expandir os limites do serving de modelos LLM e de diffusion • Trabalhar no núcleo do vLLM para otimizar a execução de modelos em diferentes hardwares e arquiteturas • Desenvolver inovações em inference runtime para arquiteturas de mixture-of-experts, multimodais e agentic • Implementar técnicas de inferência e arquiteturas de modelos descritas em artigos de pesquisa • Contribuir com código de alto desempenho e de fácil manutenção • Depurar bases de código complexas de machine learning • Melhorar diretamente a execução da inferência de IA, tornando-a mais barata e rápida

🎯 Requisitos

• Graduação ou experiência equivalente em ciência da computação, engenharia ou área similar • Conhecimento profundo de arquiteturas transformer e suas variantes • Sólidos conhecimentos de programação em Python, com experiência nos componentes internos do PyTorch • Experiência com sistemas de inferência de LLM, como vLLM, TensorRT-LLM, SGLang ou TGI • Capacidade de ler e implementar arquiteturas de modelos e técnicas de inferência descritas em artigos de pesquisa • Capacidade de contribuir com código de alto desempenho e de fácil manutenção, além de depurar bases de código complexas de ML • Desejável: conhecimento profundo de gerenciamento de memória de KV-cache, prefix caching e hybrid model serving • Desejável: familiaridade com frameworks e algoritmos de RL para LLMs • Desejável: experiência com inferência multimodal em áudio, imagem, vídeo e texto • São desejadas contribuições para projetos open source de ML ou de infraestrutura de sistemas • Diferencial: implementação de funcionalidades centrais no vLLM ou em outros projetos de inference engine • Diferencial: contribuições para integrações do vLLM, como verl, OpenRLHF, Unsloth ou LlamaFactory • Diferencial: technical blogs amplamente compartilhados ou side projects sobre vLLM ou inferência de LLM • Materiais obrigatórios para candidatura: currículo, usuário do GitHub e link para um projeto pessoal relevante, contribuição open source ou publicação técnica em blog

🏖️ Benefícios

• Pacote de benefícios competitivo, adequado à sua localização, incluindo cobertura de saúde quando aplicável • Participação acionária • Patrocínio de visto caso a caso • Trabalho totalmente remoto • Horário flexível, com sobreposição regular ao Pacific Time para alinhamentos críticos

Candidatar-se

Vagas Similares

🕒 Agosto 19

Progress Partners

51 - 200

☁️ SaaS

⚡ Produtividade

🤖 Inteligência Artificial

Engineering Delivery Manager improving predictability, quality, and visibility across external engineering teams. Progress Partners builds SaaS and mobile platforms used worldwide.

🌏 Qualquer lugar do mundo

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

🖥 Engenheiro de Software

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 2

Supabase

51 - 200

☁️ SaaS

🔌 API

🤖 Inteligência Artificial

Engenheiro de Produtividade de Engenharia na Supabase, aprimorando fluxos de desenvolvimento local e otimizando processos de engenharia. Foco em produtividade de desenvolvedores com ferramentas assistidas por IA e sistemas de CI.

🌏 Qualquer lugar do mundo

💰 $80.000.000 Series B em 2022-05

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

🖥 Engenheiro de Software

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Maio 19

Supabase

51 - 200

☁️ SaaS

🔌 API

🤖 Inteligência Artificial

Engenheiro responsável por impulsionar a evolução do OrioleDB e colaborar com a comunidade PostgreSQL na Supabase. Projetar e implementar novas funcionalidades de banco de dados e garantir a confiabilidade do sistema.

🌏 Qualquer lugar do mundo

💰 $80.000.000 Series B em 2022-05

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

🖥 Engenheiro de Software

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Março 31

ClosedWon

1 - 10

💼 Consultoria

📦 Logística

📣 Marketing

VP de Engenharia liderando a visão e a estratégia tecnológica na ClosedWon, uma empresa de coaching de vendas com IA. Colaborando com a liderança para impulsionar e implementar soluções inovadoras.

🌏 Qualquer lugar do mundo

⏰ Tempo Integral

🔴 Especialista

🖥 Engenheiro de Software

🗣️🇺🇸🇬🇧 Inglês obrigatório