
11 - 50 funcionários
Fundada em 2025
🤖 Inteligência Artificial
🤝 B2B
🏢 Corporativo
Artificial Intelligence • B2B • Enterprise
A Inferact é uma startup fundada pelos criadores e mantenedores principais do vLLM, o principal motor de inferência de LLM de código aberto. A empresa tem como objetivo acelerar o progresso da inteligência artificial, tornando a inferência de modelos mais barata e rápida, ampliando o desempenho do vLLM e o suporte para arquiteturas emergentes e hardware acelerador. A Inferact combina uma profunda experiência na interseção de modelos e hardware para fornecer infraestrutura de inferência utilizada por laboratórios de pesquisa, hyperscalers e startups, enquanto continua a desenvolver e contribuir com otimizações para a comunidade de código aberto.
🔥 0 minutos atrás
🗣️🇺🇸🇬🇧 Inglês obrigatório
Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

11 - 50 funcionários
Fundada em 2025
🤖 Inteligência Artificial
🤝 B2B
🏢 Corporativo
Artificial Intelligence • B2B • Enterprise
A Inferact é uma startup fundada pelos criadores e mantenedores principais do vLLM, o principal motor de inferência de LLM de código aberto. A empresa tem como objetivo acelerar o progresso da inteligência artificial, tornando a inferência de modelos mais barata e rápida, ampliando o desempenho do vLLM e o suporte para arquiteturas emergentes e hardware acelerador. A Inferact combina uma profunda experiência na interseção de modelos e hardware para fornecer infraestrutura de inferência utilizada por laboratórios de pesquisa, hyperscalers e startups, enquanto continua a desenvolver e contribuir com otimizações para a comunidade de código aberto.
• Expandir os limites do serving de modelos LLM e de diffusion • Trabalhar no núcleo do vLLM para otimizar a execução de modelos em diferentes hardwares e arquiteturas • Desenvolver inovações em inference runtime para arquiteturas de mixture-of-experts, multimodais e agentic • Implementar técnicas de inferência e arquiteturas de modelos descritas em artigos de pesquisa • Contribuir com código de alto desempenho e de fácil manutenção • Depurar bases de código complexas de machine learning • Melhorar diretamente a execução da inferência de IA, tornando-a mais barata e rápida
• Graduação ou experiência equivalente em ciência da computação, engenharia ou área similar • Conhecimento profundo de arquiteturas transformer e suas variantes • Sólidos conhecimentos de programação em Python, com experiência nos componentes internos do PyTorch • Experiência com sistemas de inferência de LLM, como vLLM, TensorRT-LLM, SGLang ou TGI • Capacidade de ler e implementar arquiteturas de modelos e técnicas de inferência descritas em artigos de pesquisa • Capacidade de contribuir com código de alto desempenho e de fácil manutenção, além de depurar bases de código complexas de ML • Desejável: conhecimento profundo de gerenciamento de memória de KV-cache, prefix caching e hybrid model serving • Desejável: familiaridade com frameworks e algoritmos de RL para LLMs • Desejável: experiência com inferência multimodal em áudio, imagem, vídeo e texto • São desejadas contribuições para projetos open source de ML ou de infraestrutura de sistemas • Diferencial: implementação de funcionalidades centrais no vLLM ou em outros projetos de inference engine • Diferencial: contribuições para integrações do vLLM, como verl, OpenRLHF, Unsloth ou LlamaFactory • Diferencial: technical blogs amplamente compartilhados ou side projects sobre vLLM ou inferência de LLM • Materiais obrigatórios para candidatura: currículo, usuário do GitHub e link para um projeto pessoal relevante, contribuição open source ou publicação técnica em blog
• Pacote de benefícios competitivo, adequado à sua localização, incluindo cobertura de saúde quando aplicável • Participação acionária • Patrocínio de visto caso a caso • Trabalho totalmente remoto • Horário flexível, com sobreposição regular ao Pacific Time para alinhamentos críticos
Candidatar-se🕒 Agosto 19
Engineering Delivery Manager improving predictability, quality, and visibility across external engineering teams. Progress Partners builds SaaS and mobile platforms used worldwide.
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 Agosto 2
Engenheiro de Produtividade de Engenharia na Supabase, aprimorando fluxos de desenvolvimento local e otimizando processos de engenharia. Foco em produtividade de desenvolvedores com ferramentas assistidas por IA e sistemas de CI.
🌏 Qualquer lugar do mundo
💰 $80.000.000 Series B em 2022-05
⏰ Tempo Integral
🟠 Sênior
🔴 Especialista
🖥 Engenheiro de Software
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 Maio 19
Engenheiro responsável por impulsionar a evolução do OrioleDB e colaborar com a comunidade PostgreSQL na Supabase. Projetar e implementar novas funcionalidades de banco de dados e garantir a confiabilidade do sistema.
🌏 Qualquer lugar do mundo
💰 $80.000.000 Series B em 2022-05
⏰ Tempo Integral
🟠 Sênior
🔴 Especialista
🖥 Engenheiro de Software
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 Março 31
VP de Engenharia liderando a visão e a estratégia tecnológica na ClosedWon, uma empresa de coaching de vendas com IA. Colaborando com a liderança para impulsionar e implementar soluções inovadoras.
🗣️🇺🇸🇬🇧 Inglês obrigatório