Scientifique de recherche / Ingénieur – Optimisation des performances

🔥 il y a 12 heures

🇪🇺 Europe – Télétravail

⏰ Temps Plein

🟡 Intermédiaire

🟠 Senior

🧬 Chercheur Scientifique

👻 Score fantôme 12%

infoinfo

🗣️🇺🇸🇬🇧 Anglais requis

Postuler Maintenant
Trouver des Emplois à Distance Similaires

📊 Vérifiez votre score de CV pour ce poste

Améliorez vos chances d'obtenir un entretien en vérifiant votre score de CV avant de postuler.

Logo of Luma AI

Luma AI

2 - 10 employés

🤖 Intelligence artificielle

☁️ SaaS

📱 Médias

💰 €90 000 000 Series B en 2025-01

Artificial Intelligence • SaaS • Media

Luma AI est une entreprise basée à Palo Alto qui développe des modèles d'IA générative multimodale et des outils de flux de travail créatif axés sur la production de vidéos, d'images, d'audio et de textes. Luma propose des modèles et des produits tels que Ray (génération de vidéos), UNI-1/Uni-1. 1 (modèles d'intelligence de marque), et une API/des offres d'entreprise qui permettent aux équipes créatives de générer, éditer et réaliser des contenus de qualité cinématique avec une continuité de marque. Ils mettent l'accent sur la recherche d'avant-garde (Open Physical AI Lab), le développement interne de modèles, et des produits pour les équipes créatives, les agences et les services de production. Luma fournit également des API, des plans d'entreprise, un programme de partenariats créatifs et des ressources d'apprentissage.

Description

• Analyser et optimiser le code GPU, CPU et des accélérateurs afin d'optimiser leur utilisation et de réduire la latence au minimum • Écrire du code PyTorch, Triton et CUDA hautes performances, notamment des opérations personnalisées lorsque nécessaire • Développer des kernels fusionnés et exploiter les tensor cores ainsi que les fonctionnalités des architectures matérielles modernes sur différentes plateformes • Optimiser les architectures et les implémentations de modèles pour un déploiement distribué en production sur plusieurs nœuds • Concevoir des outils de supervision et d'analyse des performances ainsi que des processus d'automatisation • Étudier et mettre en œuvre des techniques d'optimisation de pointe pour les modèles de type transformer • Analyser les pipelines actuels d'entraînement et d'inférence au cours des 30 premiers jours • Mettre en production et valider une optimisation de kernel ou d'architecture entre le 30e et le 60e jour • Mettre en place la supervision et l'automatisation nécessaires pour prévenir les régressions de performances entre le 60e et le 90e jour

🎯 Exigences

• Niveau d'expertise avancé en programmation Triton/CUDA et en optimisation GPU • Solide maîtrise de PyTorch, notamment du développement de kernels et des opérations personnalisées • Maîtrise des outils de profiling, notamment NVIDIA Nsight, torch profiler et les outils internes • Compréhension approfondie des architectures transformer et des mécanismes d'attention • Expérience des compilateurs et des exporteurs tels que torch.compile, TensorRT, ONNX ou XLA (un plus) • Expérience dans l'optimisation de workloads d'inférence en matière de latence et de débit (un plus) • Connaissance du compilateur Triton et des techniques de fusion de kernels (un plus) • Connaissance des intrinsics au niveau des warps et des techniques avancées d'optimisation CUDA (un plus)

🏖️ Avantages

• Employeur garantissant l'égalité des chances • Participation facultative à une enquête sur la diversité et l'inclusion ; le refus de participer n'aura aucune incidence sur la candidature

Postuler Maintenant

Emplois Similaires

🕒 il y a 2 jours

Synthesia

501 - 1000

📣 Marketing

💼 Conseil

📦 Logistique

Scientifique de recherche développant des modèles de diffusion pour des avatars interactifs naturels en temps réel. Synthesia développe des technologies vidéo basées sur l’IA pour la communication des entreprises et le développement des compétences en entreprise.

🇪🇺 Europe – Télétravail

🔥 Financement dans la dernière année

💰 €200 000 000 Series E - Synthesia en 2025-10

⏰ Temps Plein

🟡 Intermédiaire

🟠 Senior

🧬 Chercheur Scientifique

🗣️🇺🇸🇬🇧 Anglais requis