Membre de l'équipe technique, ingénierie de recherche

micro1
IA et machine learning
Expert
Télétravail
Temps plein
Core team

400 000 $US à 800 000 $US/anFourchette indicative communiquée par micro1

Publié le 14 septembre 2026 · Candidatures jusqu'au 13 novembre 2026

Postuler sur micro1

Je vous redirige vers la page officielle de micro1. La candidature est gratuite et se fait en anglais.

Je touche une commission de la plateforme si un candidat que j'ai orienté est recruté. Cela ne change rien pour vous.

L'ingénieur de recherche développe des environnements d'apprentissage par renforcement, des pipelines d'entraînement et des systèmes d'évaluation automatisés pour faire progresser les modèles d'IA modernes. Les candidats doivent posséder une solide expérience en apprentissage par renforcement, en conception d'environnements et un parcours avéré dans la mise à l'échelle de frameworks d'expérimentation.

Description en anglais, telle que publiée par micro1.

Job Title: Member of Technical Staff, Research Engineering

Job Type: Full-time

Location: Remote

The Role

We are seeking a Research Engineer to operate at the frontier of Reinforcement Learning (RL), developing novel environments, training pipelines, and evaluation systems that advance the capabilities of modern AI models. This role sits at the intersection of research and production, translating experimental ideas into scalable, high-performance systems.

What You’ll Work On

  • Architect self-contained RL environments that capture complex, real-world tasks, including reward functions, verifiers, and evaluation logic.
  • Design and scale episode pipelines and multi-component training processes (MCPs) to support reproducible experimentation.
  • Build automated data generation systems, leveraging synthetic data to accelerate training cycles without compromising quality.
  • Develop and integrate AI-driven evaluation and quality assurance systems for automated grading, validation, and feedback loops.
  • Fine-tune and optimize open-source RL models using internally generated datasets and custom training strategies.
  • Establish benchmarking frameworks to measure model capability, robustness, and data quality across tasks.
  • Contribute to the release and analysis of evaluations on internal and external benchmark platforms (e.g., micro1 benchmarks).

What We're Looking For

  • Deep experience in Reinforcement Learning, including environment design and training dynamics.
  • Strong track record of building and scaling RL systems, pipelines, or experimentation frameworks.
  • Proficient in automation and data generation, including synthetic data pipelines.
  • Familiar with automated evaluation systems, model validation, and quality assurance workflows.
  • Experienced in fine-tuning and evaluating open-source ML models.
  • Clear, concise communicator with strong technical writing skills.
  • Comfortable operating in fast-paced, research-driven, and highly collaborative environments.

Preferred

  • Experience publishing benchmarks, evaluations, or research artifacts.
  • Familiarity with evaluation ecosystems (e.g., micro1 benchmarks or similar frameworks).
  • Background in scalable infrastructure for large-scale RL experimentation.

Compensation & Benefits Notice

The national pay range for this full-time position is base salary of $200,000, $300,000 USD. All employees are eligible for equity compensation, and employees may also receive performance-based bonuses, dependent on role and subject to company policies. micro1 provides a comprehensive benefits package, including up to 100% reimbursement for health-insurance premiums, paid time off, a 401(K) plan with a company match, and additional benefits designed to support a high-performing, remote-first workforce.

micro1 is an equal opportunity employer. All qualified applicants will receive consideration for employment without regard to race, color, religion, sex (including pregnancy, sexual orientation, or gender identity), national origin, age, disability, genetic information, veteran status, or any other characteristic protected by applicable local laws, regulations and ordinances. If you need assistance and/or a reasonable accommodation during the application process, reach out to support@micro1.ai.

Our hiring process utilizes artificial intelligence tools to assist in candidate screening and assessment. Our AI tools are designed to complement, not replace, human decision-making.

Disclaimer

The information contained in this job posting, including but not limited to role responsibilities, qualifications, compensation, and benefits, is provided for informational purposes only and does not constitute a binding offer of employment. micro1 reserves the right to amend, modify, or withdraw any portion of this posting at its sole discretion and without prior notice. All employment decisions are made in accordance with applicable laws and regulations.

Compétences recherchées

  • Reinforcement Learning
  • ML-Oriented Data Design
  • RL Environments
  • RL Workflows

À propos de micro1

micro1 est un labo de données IA qui recrute des experts à distance pour entraîner et évaluer des modèles. L'offre originale est consultable sur leur site.

Voir l'offre sur micro1

Autres postes en IA et machine learning

Ingenieur CQ - Gestion DataOS

Turing
IA et machine learning
Télétravail
Temps plein

Ce role de prestataire distant consiste a superviser les pipelines de controle qualite, a evaluer les resultats des projets techniques et a garantir des normes elevees pour les flux de donnees d'IA. Les candidats doivent posseder de solides bases en genie logiciel et une experience prealable en tant qu'expert en controle qualite ou chef de projet technique.

  • QA
  • Quality Management

Publié il y a 3 j

Entraineur LLM - Appel de fonction d'agent

Turing
IA et machine learning
Télétravail
Temps plein

L'entraineur LLM concoit des conversations a tours multiples et simule l'utilisation d'outils pour aider les entreprises d'IA fondamentale a entrainer et evaluer leurs modeles. Le poste exige de solides competences en raisonnement technique, une experience avec les API et les formats de donnees, ainsi que trois annees d'experience technique professionnelle.

  • Python
  • Java
  • JavaScript

Publié il y a 4 j

Membre du personnel technique, IA d'entreprise

micro1
IA et machine learning
Expert
Télétravail
Temps plein
Core team

Ce poste s'intègre au sein des systèmes d'IA d'entreprise pour diagnostiquer des défaillances, concevoir des jeux de données d'évaluation et exécuter des expériences. Les candidats doivent détenir un master en informatique ou en apprentissage automatique et justifier d'une solide expérience dans la conception de cadres d'évaluation pour le machine learning.

  • Research Signal Judgment
  • ML-Oriented Data Design
  • Ops-to-Research Translation
  • +1

Publié il y a 4 j300 000 $US à 700 000 $US/an

Ingénieur déployé sur le terrain

micro1
IA et machine learning
Télétravail
Temps plein
Core team

L'ingénieur déployé sur le terrain collabore avec les principaux laboratoires d'IA et entreprises pour créer des pipelines de ML, des systèmes d'intelligence des données et des flux de travail agentiques. Les candidats doivent être de solides ingénieurs Python possédant une expérience professionnelle dans la création de systèmes de production et l'utilisation de grands modèles de langage.

  • Python
  • LLM Systems
  • ML Infrastructure
  • +1

Publié il y a 4 j300 000 $US à 650 000 $US/an