Annotateur LLM - Niveau Master

Turing
Analyse de données
Télétravail
Temps plein

Publié le 14 septembre 2026 · Candidatures jusqu'au 18 octobre 2026

Postuler sur Turing

Je vous redirige vers la page officielle de Turing. La candidature est gratuite et se fait en anglais.

Je touche une commission de la plateforme si un candidat que j'ai orienté est recruté. Cela ne change rien pour vous.

L'annotateur LLM evalue des modeles d'intelligence artificielle en creant des invites complexes, en evaluant la precision des reponses et en documentant les lacunes de raisonnement. Le candidat ideal detient un niveau Master et possede au moins trois annees d'experience professionnelle, de recherche ou d'enseignement.

Description en anglais, telle que publiée par Turing.

About Turing:

Based in San Francisco, California, Turing is the world's leading research accelerator for frontier AI labs and a trusted partner for global enterprises deploying advanced AI systems. Turing supports customers in two ways: first, by accelerating frontier research with high-quality data, advanced training pipelines, plus top AI researchers who specialize in coding, reasoning, STEM, multilinguality, multimodality, and agents; and second, by applying that expertise to help enterprises transform AI from proof of concept into proprietary intelligence with systems that perform reliably, deliver measurable impact, and drive lasting results on the P&L.

Role Overview

We are seeking highly motivated LLM Annotators to support the evaluation and improvement of cutting-edge Large Language Models (LLMs). In this role, you will analyze structured data, create challenging prompts, evaluate AI-generated responses for factual accuracy and reasoning quality, and provide evidence-backed feedback to improve model performance.

We are looking for curious, detail-oriented professionals who enjoy solving complex problems and evaluating AI systems. The ideal candidate can analyze data, think critically, validate responses against evidence, and clearly articulate why a model's output is correct or incorrect. Experience working with AI models and creating challenging evaluation prompts is a strong advantage.

Key Responsibilities

  • Create challenging prompts that evaluate an LLM's ability to retrieve, analyze, and reason over structured data.
  • Assess AI-generated responses for factual accuracy, logical reasoning, and completeness.
  • Identify model failures, inconsistencies, hallucinations, and reasoning gaps.
  • Validate model outputs using provided datasets and supporting evidence.
  • Document findings with clear, evidence-based explanations.
  • Consistently follow annotation guidelines and maintain high-quality standards.

Minimum Qualifications

  • Master's degree or higher in any discipline.
  • Minimum 3 years of professional, research, or teaching experience.
  • Strong analytical and critical thinking skills.
  • Excellent written English communication skills.
  • Exceptional attention to detail and ability to validate information against source data.

    Preferred Qualifications
  • Experience working with Large Language Models (LLMs) or Generative AI.
  • Familiarity with prompt engineering, AI evaluation, data annotation, or model testing.
  • Experience working with structured datasets (CSV, Excel, databases, etc.).
  • Ability to identify edge cases and design prompts that expose model limitations.

    Benefits
  • Opportunity to work on cutting-edge AI projects.
  • Competitive compensation.
  • Flexible working hours and remote work environment.

Offer Details

  • Commitments Required: 40, 30 or 20 hours per week with at least 4 hours PST overlap
  • Employment type: Contractor assignment (no medical/paid leave)
  • Duration of contract: 4 weeks


    Evaluation Process:
  • Shortlisting based on qualifications and assessment scores.

Compétences recherchées

  • Prompt Engineering
  • Teaching
  • Data Analysis

À propos de Turing

Turing recrute des experts à distance pour des projets d'IA et d'ingénierie, du développement à la médecine. L'offre originale est consultable sur leur site.

Voir l'offre sur Turing

Autres postes en Analyse de données

Ingénieur Backend Senior (Python, SQL et intégration IA)

Turing
Analyse de données
Télétravail
Temps plein

Ce poste consiste à concevoir des services backend en Python, des API et des flux de travail automatisés par LLM tout en gérant des bases de données PostgreSQL. Le candidat idéal possède une solide maîtrise de Python et une expérience pratique de l'optimisation des requêtes de base de données.

  • Python
  • SQL
  • GCP AppEngine

Publié hier

Expert en analyse de graphiques et de visualisation de données

micro1
Analyse de données
Spécialiste
Télétravail
Freelance

Le prestataire interprète et analyse des graphiques et des visualisations de données spécialisés afin de concevoir des tâches de raisonnement quantitatif et des solutions étape par étape pour l'entraînement d'une IA. Les exigences comprennent une licence dans un domaine pertinent et au moins deux ans d'expérience dans le traitement de données quantitatives ou de graphiques.

  • Chart interpretation accuracy
  • Multi-step quantitative reasoning
  • Question design / unambiguous task construction
  • +2

Publié hier25 $US à 50 $US/h

Biostatisticien

micro1
Analyse de données
Généraliste
Télétravail
Freelance

Ce biostatisticien contractuel à distance conçoit des tâches d'évaluation expertes, des ensembles de données authentiques et des grilles de notation pour entraîner des systèmes d'IA. Les exigences incluent une maîtrise ou un doctorat en biostatistique, en statistique ou en épidémiologie, ainsi que quatre années ou plus d'expérience pertinente.

  • Methodological rigor
  • Clinical interpretation
  • Regulatory sensitivity
  • +1

Publié il y a 2 j60 $US à 100 $US/h