Annotateur LLM - Niveau Master
Publié le 14 septembre 2026 · Candidatures jusqu'au 18 octobre 2026
Je vous redirige vers la page officielle de Turing. La candidature est gratuite et se fait en anglais.
Je touche une commission de la plateforme si un candidat que j'ai orienté est recruté. Cela ne change rien pour vous.
L'annotateur LLM evalue des modeles d'intelligence artificielle en creant des invites complexes, en evaluant la precision des reponses et en documentant les lacunes de raisonnement. Le candidat ideal detient un niveau Master et possede au moins trois annees d'experience professionnelle, de recherche ou d'enseignement.
Description en anglais, telle que publiée par Turing.
About Turing:
Based in San Francisco, California, Turing is the world's leading research accelerator for frontier AI labs and a trusted partner for global enterprises deploying advanced AI systems. Turing supports customers in two ways: first, by accelerating frontier research with high-quality data, advanced training pipelines, plus top AI researchers who specialize in coding, reasoning, STEM, multilinguality, multimodality, and agents; and second, by applying that expertise to help enterprises transform AI from proof of concept into proprietary intelligence with systems that perform reliably, deliver measurable impact, and drive lasting results on the P&L.
Role Overview
We are seeking highly motivated LLM Annotators to support the evaluation and improvement of cutting-edge Large Language Models (LLMs). In this role, you will analyze structured data, create challenging prompts, evaluate AI-generated responses for factual accuracy and reasoning quality, and provide evidence-backed feedback to improve model performance.
We are looking for curious, detail-oriented professionals who enjoy solving complex problems and evaluating AI systems. The ideal candidate can analyze data, think critically, validate responses against evidence, and clearly articulate why a model's output is correct or incorrect. Experience working with AI models and creating challenging evaluation prompts is a strong advantage.
Key Responsibilities
- Create challenging prompts that evaluate an LLM's ability to retrieve, analyze, and reason over structured data.
- Assess AI-generated responses for factual accuracy, logical reasoning, and completeness.
- Identify model failures, inconsistencies, hallucinations, and reasoning gaps.
- Validate model outputs using provided datasets and supporting evidence.
- Document findings with clear, evidence-based explanations.
- Consistently follow annotation guidelines and maintain high-quality standards.
Minimum Qualifications
- Master's degree or higher in any discipline.
- Minimum 3 years of professional, research, or teaching experience.
- Strong analytical and critical thinking skills.
- Excellent written English communication skills.
- Exceptional attention to detail and ability to validate information against source data.
Preferred Qualifications - Experience working with Large Language Models (LLMs) or Generative AI.
- Familiarity with prompt engineering, AI evaluation, data annotation, or model testing.
- Experience working with structured datasets (CSV, Excel, databases, etc.).
- Ability to identify edge cases and design prompts that expose model limitations.
Benefits - Opportunity to work on cutting-edge AI projects.
- Competitive compensation.
- Flexible working hours and remote work environment.
Offer Details
- Commitments Required: 40, 30 or 20 hours per week with at least 4 hours PST overlap
- Employment type: Contractor assignment (no medical/paid leave)
- Duration of contract: 4 weeks
Evaluation Process: - Shortlisting based on qualifications and assessment scores.
Compétences recherchées
- Prompt Engineering
- Teaching
- Data Analysis
À propos de Turing
Turing recrute des experts à distance pour des projets d'IA et d'ingénierie, du développement à la médecine. L'offre originale est consultable sur leur site.
Voir l'offre sur TuringAutres postes en Analyse de données
Ingénieur Backend Senior (Python, SQL et intégration IA)
Ce poste consiste à concevoir des services backend en Python, des API et des flux de travail automatisés par LLM tout en gérant des bases de données PostgreSQL. Le candidat idéal possède une solide maîtrise de Python et une expérience pratique de l'optimisation des requêtes de base de données.
- Python
- SQL
- GCP AppEngine
Publié hier
Expert en analyse de graphiques et de visualisation de données
Le prestataire interprète et analyse des graphiques et des visualisations de données spécialisés afin de concevoir des tâches de raisonnement quantitatif et des solutions étape par étape pour l'entraînement d'une IA. Les exigences comprennent une licence dans un domaine pertinent et au moins deux ans d'expérience dans le traitement de données quantitatives ou de graphiques.
- Chart interpretation accuracy
- Multi-step quantitative reasoning
- Question design / unambiguous task construction
- +2
Publié hier25 $US à 50 $US/h
Utilisateurs d'iPhone : gagnez de l'argent en partageant vos données de fitness (États-Unis uniquement)
Le contributeur alimente un profil Apple HealthKit avec des activités de fitness détaillées et associe des dossiers cliniques provenant d'un établissement de santé éligible. Les candidats doivent fournir des données de santé vérifiées et des notes cliniques provenant d'une liste de prestataires approuvés.
Publié il y a 2 j
Biostatisticien
Ce biostatisticien contractuel à distance conçoit des tâches d'évaluation expertes, des ensembles de données authentiques et des grilles de notation pour entraîner des systèmes d'IA. Les exigences incluent une maîtrise ou un doctorat en biostatistique, en statistique ou en épidémiologie, ainsi que quatre années ou plus d'expérience pertinente.
- Methodological rigor
- Clinical interpretation
- Regulatory sensitivity
- +1
Publié il y a 2 j60 $US à 100 $US/h