
1 - 10 employés
Fondée en 2023
🤖 Intelligence artificielle
☁️ SaaS
🔌 API
Artificial Intelligence • SaaS • API
Featherless AI est un fournisseur de services d'inférence AI sans serveur et d'hébergement de modèles qui offre un accès API à un vaste catalogue de modèles à poids ouvert (plus de 12 200), permettant aux développeurs et aux entreprises de déployer, ajuster et exécuter des modèles à grande échelle sans gérer de serveurs. La société propose un tarif d'abonnement forfaitaire avec des jetons illimités, l'orchestration GPU, une utilisation privée/anonyme (sans journaux) et des options de self-hosting pour les entreprises ou des unités de mise à l'échelle pour une haute simultanéité. Featherless AI fonctionne également comme un laboratoire de recherche en intelligence artificielle axé sur la recherche open-source et post-transformateur, revendiquant des améliorations significatives en termes de coûts et de performance pour les grands modèles et agents IA.
🕒 il y a 5 mois
🗣️🇺🇸🇬🇧 Anglais requis
Améliorez vos chances d'obtenir un entretien en vérifiant votre score de CV avant de postuler.

1 - 10 employés
Fondée en 2023
🤖 Intelligence artificielle
☁️ SaaS
🔌 API
Artificial Intelligence • SaaS • API
Featherless AI est un fournisseur de services d'inférence AI sans serveur et d'hébergement de modèles qui offre un accès API à un vaste catalogue de modèles à poids ouvert (plus de 12 200), permettant aux développeurs et aux entreprises de déployer, ajuster et exécuter des modèles à grande échelle sans gérer de serveurs. La société propose un tarif d'abonnement forfaitaire avec des jetons illimités, l'orchestration GPU, une utilisation privée/anonyme (sans journaux) et des options de self-hosting pour les entreprises ou des unités de mise à l'échelle pour une haute simultanéité. Featherless AI fonctionne également comme un laboratoire de recherche en intelligence artificielle axé sur la recherche open-source et post-transformateur, revendiquant des améliorations significatives en termes de coûts et de performance pour les grands modèles et agents IA.
• Rechercher et développer de nouvelles architectures de réseaux de neurones (par ex. alternatives ou extensions aux Transformers, modèles récurrents/hybrides, systèmes gérant de longs contextes) • Concevoir et réaliser des expériences au niveau de l'architecture (lois d'échelle, mécanismes de mémoire, compromis en termes de calcul) • Prototyper des modèles de bout en bout — du code de recherche aux implémentations prêtes pour l'entraînement • Collaborer avec les ingénieurs d'inférence et systèmes pour garantir que les architectures sont déployables et efficaces • Analyser le comportement des modèles, les modes de défaillance et les biais inductifs • Lire, reproduire et étendre des articles de recherche à la pointe • Contribuer aux notes de recherche internes, aux benchmarks et aux projets open source (le cas échéant)
• Solide formation en fondements de l'apprentissage automatique et en apprentissage profond • Expérience pratique d'implémentation d'architectures de modèles à partir de zéro • Compréhension solide de : • • Mécanismes d'attention, RNN, modèles d'espace d'état (SSM) ou architectures hybrides • • Dynamiques d'entraînement, comportement à l'échelle et optimisation • • Contraintes de mémoire, de latence et de calcul au niveau du modèle • À l'aise avec PyTorch ou JAX • Capacité à passer aisément de la théorie à l'expérimentation et à l'ingénierie • Communicateur clair, capable d'expliquer les compromis d'architecture • Atouts • • Expérience avec des architectures non-Transformer (variantes de RNN, SSM, modèles pour longs contextes) • • Expérience dans des startups axées recherche ou des projets ML open source • • Expérience en entraînement à grande échelle ou en boucles d'entraînement personnalisées • • Publications, preprints ou contributions de recherche notables • • Connaissance de l'optimisation de l'inférence et des contraintes de déploiement
• Rémunération compétitive + participation au capital significative
Postuler Maintenant