Ingénieur·e benchmark IA | Spécialiste linguistique natif·ve – français (France) – Télétravail

🔥 il y a 1 heure

🇫🇷 France – Télétravail

⏳ Contrat

🟡 Intermédiaire

🟠 Senior

🤖 Intelligence Artificielle

👻 Score fantôme 25%

infoinfo

🗣️🇺🇸🇬🇧 Anglais requis

Postuler Maintenant
Trouver des Emplois à Distance Similaires

📊 Vérifiez votre score de CV pour ce poste

Améliorez vos chances d'obtenir un entretien en vérifiant votre score de CV avant de postuler.

Logo of LILT AI

LILT AI

201 - 500 employés

Fondée en 2015

🤖 Intelligence artificielle

☁️ SaaS

🏢 Entreprise

💰 €24 999 992 Funding Round - LILT en 2025-06

Artificial Intelligence • SaaS • Enterprise

LILT AI est une plateforme d'intelligence artificielle multilingue qui aide les entreprises et les organisations du secteur public à créer, traduire, vérifier et gérer du contenu dans plusieurs langues à grande échelle. Elle combine des modèles d'IA spécifiques à chaque domaine, un entraînement continu des modèles, et une couche d'intelligence humaine fournies par des linguistes professionnels pour offrir une localisation sécurisée, des vérifications de traduction conformes à la marque, et le développement de modèles multilingues. La plateforme propose une gestion de projet à l'échelle de l'entreprise, plus de 100 intégrations natives, des déploiements sur site et en environnement isolé, ainsi que des outils pour entraîner, évaluer et réguler l'IA multilingue pour des cas d'utilisation comme la localisation de sites web, les lancements de produits, la documentation technique, et les communications réglementaires/de conformité.

Description

• Concevoir, développer et valider des tâches Terminal-Bench pour des défis logiciels multilingues • Évaluer des agents de programmation • Créer des environnements de tâches réalistes à l’aide de jeux de données et de fichiers en français, en conservant les ressources dans la langue cible • Identifier les points de défaillance de l’IA grâce au prompting et à des travaux de traduction en français • Contribuer à la mise en place d’implémentations de référence robustes • Rédiger des scripts de vérification fiables et déterministes • Analyser les journaux d’exécution et calibrer la difficulté des tâches, de Facile à Très difficile • Exécuter les configurations Terminal-Bench standard avec les niveaux de modèles Haiku, Sonnet et Opus • Participer à un processus de contrôle qualité humain en quatre niveaux : création, revue humaine, revue de calibration et audit • Travailler avec des contrôles automatisés fondés sur des LLM afin de garantir l’équité, l’exactitude grammaticale et l’intégrité du benchmark

🎯 Exigences

• Au moins 5 ans d’expérience professionnelle en ingénierie logicielle • Expérience avérée au sein d’entreprises technologiques de premier plan et/ou diplôme délivré par une grande école d’ingénieurs de premier rang • Maîtrise native ou quasi native du français, avec une compréhension approfondie de la grammaire, des registres et des règles de formulation • Très bon niveau d’anglais • Excellente maîtrise de Python, des scripts shell standards et du traitement des données • Expérience approfondie des workflows de développement fondés sur le terminal/la CLI • Bonne connaissance pratique des agents de programmation • Compréhension technique approfondie des difficultés liées au traitement multilingue des textes • Expérience de la robustesse de l’encodage/décodage et de la normalisation Unicode • Connaissance des conventions dépendant des paramètres régionaux, notamment le classement, la casse et les calendriers non grégoriens • Connaissance des entrées/sorties texte, de l’interopérabilité des toolchains et des opérations sûres sur les chaînes de caractères • Pour les langues concernées, connaissance de la gestion bidirectionnelle/RTL, des mécanismes de substitution de polices et du rendu/de la typographie • CV à jour en anglais • Réussite à une évaluation GenAI • Disponibilité et engagement fiables ; la plupart des tâches nécessitent au moins 2 heures par jour ou 10 heures par semaine • Les prestataires doivent être en mesure de respecter les restrictions géographiques applicables et sont responsables de leurs propres obligations fiscales

🏖️ Avantages

• Horaires flexibles et possibilité de travailler autant ou aussi peu que souhaité • Rémunération compétitive • Paiements rapides • Accès à des projets variés et innovants • Développement du portfolio et des compétences dans différents secteurs et domaines • Communauté internationale de linguistes, d’experts métier et de professionnels des langues • Aucun horaire fixe, point de suivi ni micromanagement

Postuler Maintenant

Emplois Similaires

🕒 il y a 27 jours

Perle Systems

51 - 200

🏭 Fabrication

📦 Logistique

💼 Conseil

Contributeur de mouvements faciaux enregistrant de courtes vidéos pour les données d’entraînement en computer vision de Perle AI. Réalisation de tâches simples basées sur la caméra à distance dans six pays éligibles.

🗣️🇺🇸🇬🇧 Anglais requis

🕒 il y a 1 mois

UNESCO

1001 - 5000

📚 Éducation

🤝 À but non lucratif

🌍 Impact social

Consultant·e chercheur·se pour l'UNESCO comparant les cadres de gouvernance de l'IA dans sept juridictions. Production de profils politiques et de recommandations pour une IA inclusive et éthique dans les secteurs culturels et créatifs.

🗣️🇺🇸🇬🇧 Anglais requis

🕒 il y a 1 mois

Welo Global

1001 - 5000

🤖 Intelligence artificielle

🤝 B2B

☁️ SaaS

Analyste en IA générative responsable d'évaluer et d'annoter des contenus générés par l'IA. Rejoignez la communauté mondiale de Welo Data et contribuez aux systèmes d'IA générative de nouvelle génération.

🗣️🇺🇸🇬🇧 Anglais requis

🕒 il y a 1 mois

Volga Partners

1001 - 5000

🤖 Intelligence artificielle

🤝 B2B

🏢 Entreprise

Examinateur en évaluation et annotation d'AI évaluant du contenu généré par l'AI en français pour un important projet AI. Réalise des analyses linguistiques et fournit des retours pour améliorer les performances du système AI.

🇫🇷 France – Télétravail

💵 $15 - $18 / heure

⏳ Contrat

🟡 Intermédiaire

🟠 Senior

🤖 Intelligence Artificielle

🗣️🇺🇸🇬🇧 Anglais requis

🕒 il y a 3 mois

RWS Group

5001 - 10000

💼 Conseil

🏥 Santé

⚖️ Juridique

Spécialiste en évaluation d'IA vocale évaluant des contenus générés par l'IA en français, offrant flexibilité et travail à distance. Idéal pour les étudiants ou les travailleurs en missions ponctuelles souhaitant contribuer au développement de l'IA.

🗣️🇺🇸🇬🇧 Anglais requis