Talent.com
Autodesk
Research Lead / Principal Scientist & Manager Post-Training · Alignment · Reinforcement LearningAutodesk • Montreal, QC, CAN
Research Lead / Principal Scientist & Manager Post-Training · Alignment · Reinforcement Learning

Research Lead / Principal Scientist & Manager Post-Training · Alignment · Reinforcement Learning

Autodesk • Montreal, QC, CAN
30+ days ago
Job type
  • Full-time
  • Remote
Job description

Position Overview

Foundation models are reshaping how engineers, architects, and designers work — but training foundation models that are reliable, domain-capable systems is still an open research problem.

Autodesk touches more of the physical world than almost any other software company. The products we build are used to design skyscrapers, manufacture aircraft, and produce films. AI is now central to how those workflows are evolving — and post-training is the layer that makes the difference between a capable model and one that is dependable and robust in our customers’ high-precision domains.

As Research Lead for Post-Training & Alignment, you will own Autodesk's research strategy for transforming foundation models into systems that are reliable, aligned, and genuinely useful in complex, domain-specific workflows. This is a deeply technical leadership role — you will shape research direction, drive key architectural decisions, and remain close to the work.

You will lead a growing team of AI scientists while continuing to contribute directly to research: running experiments, developing novel algorithms, and publishing at top-tier venues.

Autodesk's domains — architecture, engineering, construction, manufacturing, media & entertainment — provide a distinctive research environment: rich structured data, long-horizon reasoning tasks, and real-world evaluation grounded in professional workflows. Uniquely, decades of investment in physics simulation engines, CAD kernels, and computational design tools give us something most labs don't have: high-fidelity, domain-grounded verifiers that can serve as reward signals for post-training. Rather than relying solely on human preference data, we can ground reinforcement learning in the laws of physics and the constraints of real engineering. These are exactly the kinds of challenges — and assets — that make post-training and alignment research here genuinely distinctive.

We publish at NeurIPS, ICML, ICLR, CVPR, and SIGGRAPH. We collaborate with leading academic and industry labs. And we have a direct line from research advances to product impact at scale. This is not a role where research sits behind a wall from engineering — you will see your work matter.

This role reports to the Senior Director of AI Research within Autodesk AI Lab.

Post-Training · Alignment · Reinforcement Learning

Autodesk AI Lab: London · San Francisco · Toronto · Remote (US/CA/EU)

Responsibilities

Research & Technical Leadership

  • Own post-training strategy for model development — from RLHF and preference optimization to agentic systems and long-horizon reasoning

  • Develop novel algorithms that improve model reliability, controllability, and alignment

  • Make principled architectural decisions about when to address challenges at the pre-training, post-training, or system level

  • Design and run experiments that shape model behavior, robustness, and reasoning quality

  • Partner with infrastructure teams to build scalable, reproducible post-training workflows

  • Contribute to publications, patents, and Autodesk's external research visibility

Evaluation & Model Quality

  • Design evaluation frameworks for long-horizon reasoning, tool use, agentic behavior, safety, and real-world workflow completion

  • Lead rigorous model analysis and interpretability efforts

  • Drive human-in-the-loop evaluation with high annotation quality and sound scientific methodology

  • Establish model readiness criteria and provide go/no-go recommendations for releases

  • Communicate technical risks, limitations, and trade-offs clearly to leadership

Team & Organizational Leadership

  • Manage, mentor, and grow a team of AI scientists

  • Set technical direction and research priorities across post-training and alignment initiatives

  • Foster a research culture grounded in scientific rigor, reproducibility, and fast iteration

  • Help recruit world-class talent across ML, RL, alignment, and foundation models

  • Partner closely with pre-training teams, infrastructure, product organizations, and other stakeholders

  • Translate research trade-offs into clear, decision-ready guidance for leadership

Minimum Qualifications

We care about research judgment and outcomes, not credential checklists. Strong candidates will typically have:

  • Deep hands-on expertise in reinforcement learning for foundation models, and fluency with post-training methods (RLHF, RLAIF, DPO, PPO, or adjacent approaches)

  • Proven experience leading or mentoring technical research teams — whether in an academic lab, AI research organization, or industry setting

  • Strong intuition for model behavior, alignment challenges, and post-training trade-offs

  • Experience designing evaluation systems and thinking rigorously about what it means for a model to be ready

  • Ability to communicate complex technical trade-offs clearly to both technical and non-technical audiences

  • A PhD or equivalent depth of industry research experience in ML, RL, AI, or a related field

Preferred Qualifications

  • Experience at a frontier model lab or advanced applied AI organization

  • A strong publication record at leading ML or AI venues

  • Background in alignment research, preference learning, or agentic AI

  • Experience deploying or supporting production AI systems

  • Familiarity with large-scale training infrastructure and compute trade-offs

The Ideal Candidate

In the first year, success means:

  • Post-trained models show measurable improvements in reliability, alignment, reasoning quality, and domain usefulness

  • Evaluation metrics and release criteria are trusted and adopted across teams

  • The team delivers high-quality research with practical impact — and team members are growing into stronger, more independent researchers

  • Leadership relies on your judgment for model readiness, technical direction, and risk assessment

  • Autodesk AI Lab advances its reputation as a serious contributor to frontier AI research

______________________________________________________________________________________________________________

26WD98297, Responsable de recherche / Chercheur principal et responsable de la formation post-apprentissage · Alignement · Apprentissage par renforcement Autodesk AI Lab : Toronto · Télétravail

À propos d'Autodesk AI Lab

Autodesk AI Lab mène des recherches de pointe dans les domaines de l'IA générative, des modèles de base multimodaux, des systèmes de raisonnement et de la collaboration entre l'humain et l'IA. Nos travaux ont un impact direct sur les secteurs qui façonnent le monde physique. Nous contribuons activement à la communauté mondiale de la recherche et collaborons étroitement avec des laboratoires universitaires et industriels de premier plan.

Chez Autodesk, nous construisons un lieu de travail diversifié et une culture inclusive afin de donner à davantage de personnes la chance d’imaginer, de concevoir et de créer un monde meilleur. Autodesk est fier d'être un employeur garantissant l'égalité des chances et prend en considération toutes les candidatures qualifiées sans distinction de race, de couleur, de religion, d'âge, de sexe, d'orientation sexuelle, d'identité de genre, d'origine nationale, de handicap, de statut d'ancien combattant ou de toute autre caractéristique protégée par la loi.

Présentation du poste

Les modèles de base sont en train de transformer la façon dont les ingénieurs, les architectes et les concepteurs travaillent — mais la formation de modèles de base fiables et adaptés à un domaine spécifique reste un problème de recherche non résolu.

Autodesk touche davantage le monde physique que presque toute autre entreprise de logiciels. Les produits que nous développons sont utilisés pour concevoir des gratte-ciel, fabriquer des avions et produire des films. L’IA est désormais au cœur de l’évolution de ces flux de travail — et le post-entraînement est la couche qui fait la différence entre un modèle performant et un modèle fiable et robuste dans les domaines de haute précision de nos clients.

En tant que responsable de la recherche en post-entraînement et alignement, vous serez en charge de la stratégie de recherche d’Autodesk visant à transformer les modèles de base en systèmes fiables, alignés et véritablement utiles dans des flux de travail complexes et spécifiques à un domaine. Il s’agit d’un poste de direction hautement technique : vous définirez l’orientation de la recherche, piloterez les décisions architecturales clés et resterez au cœur de l’action.

Vous dirigerez une équipe grandissante de chercheurs en IA tout en continuant à contribuer directement à la recherche : en menant des expériences, en développant des algorithmes novateurs et en publiant dans des revues de premier plan.

Les domaines d’Autodesk — architecture, ingénierie, construction, fabrication, médias et divertissement — offrent un environnement de recherche unique : des données structurées riches, des tâches de raisonnement à long terme et une évaluation en conditions réelles ancrée dans des flux de travail professionnels. De manière unique, des décennies d’investissement dans les moteurs de simulation physique, les noyaux de CAO et les outils de conception computationnelle nous confèrent un atout que la plupart des laboratoires n’ont pas : des vérificateurs haute fidélité, ancrés dans le domaine, pouvant servir de signaux de récompense pour le post-entraînement. Plutôt que de nous fier uniquement aux données de préférences humaines, nous pouvons ancrer l’apprentissage par renforcement dans les lois de la physique et les contraintes de l’ingénierie réelle. Ce sont précisément ces types de défis — et d'atouts — qui rendent la recherche sur le post-entraînement et l'alignement ici véritablement unique.

Nous publions dans NeurIPS, ICML, ICLR, CVPR et SIGGRAPH. Nous collaborons avec des laboratoires universitaires et industriels de premier plan. Et nous disposons d'un lien direct entre les avancées de la recherche et l'impact des produits à grande échelle. Il ne s'agit pas d'un poste où la recherche est isolée de l'ingénierie : vous verrez que votre travail a un impact réel.

Ce poste est rattaché au directeur principal de la recherche en IA au sein de l’Autodesk AI Lab.

Post-entraînement · Alignement · Apprentissage par renforcement

Autodesk AI Lab : Londres · San Francisco · Toronto · À distance (États-Unis/Canada/UE)

Responsabilités

Leadership en matière de recherche et de technologie

  • Définir la stratégie de post-entraînement pour le développement de modèles — du RLHF et de l’optimisation des préférences aux systèmes agentiels et au raisonnement à long terme

  • Développer des algorithmes novateurs qui améliorent la fiabilité, la contrôlabilité et l’alignement des modèles

  • Prendre des décisions architecturales fondées sur des principes pour déterminer quand relever les défis au niveau de la pré-formation, de la post-formation ou du système

  • Concevoir et mener des expériences qui façonnent le comportement, la robustesse et la qualité du raisonnement des modèles

  • Collaborer avec les équipes d’infrastructure pour mettre en place des workflows de post-formation évolutifs et reproductibles

  • Contribuer aux publications, aux brevets et à la visibilité de la recherche externe d’Autodesk

Évaluation et qualité des modèles

  • Concevoir des cadres d'évaluation pour le raisonnement à long terme, l'utilisation des outils, le comportement agentique, la sécurité et l'exécution des flux de travail en conditions réelles

  • Diriger des efforts rigoureux d'analyse et d'interprétabilité des modèles

  • Mener des évaluations « human-in-the-loop » avec une annotation de haute qualité et une méthodologie scientifique solide

  • Établir des critères de maturité des modèles et fournir des recommandations de lancement ou de suspension pour les versions

  • Communiquer clairement les risques techniques, les limites et les compromis à la direction

Direction d'équipe et organisationnelle

  • Gérer, encadrer et développer une équipe de chercheurs en IA

  • Définir l'orientation technique et les priorités de recherche pour les initiatives de post-entraînement et d'alignement

  • Favoriser une culture de recherche fondée sur la rigueur scientifique, la reproductibilité et l'itération rapide

  • Contribuer au recrutement de talents de classe mondiale dans les domaines du ML, du RL, de l'alignement et des modèles de base

  • Travailler en étroite collaboration avec les équipes de pré-entraînement, les équipes d'infrastructure, les organisations produit et les autres parties prenantes

  • Traduire les compromis de recherche en recommandations claires et prêtes à l'emploi pour la direction

Qualifications minimales

Nous accordons de l’importance au jugement et aux résultats de la recherche, et non à une liste de diplômes. Les candidats idéaux possèdent généralement :

  • Une expertise pratique approfondie en apprentissage par renforcement pour les modèles de base, et une maîtrise des méthodes de post-entraînement (RLHF, RLAIF, DPO, PPO ou approches connexes)

  • Une expérience avérée dans la direction ou l'encadrement d'équipes de recherche technique — que ce soit dans un laboratoire universitaire, un organisme de recherche en IA ou en milieu industriel

  • Une intuition solide concernant le comportement des modèles, les défis d'alignement et les compromis post-entraînement

  • Une expérience dans la conception de systèmes d'évaluation et une réflexion rigoureuse sur ce que signifie pour un modèle d'être prêt

  • La capacité à communiquer clairement des compromis techniques complexes à des publics tant techniques que non techniques

  • Un doctorat ou une expérience de recherche industrielle d'un niveau équivalent en ML, RL, IA ou dans un domaine connexe

Qualifications souhaitées

  • Expérience au sein d’un laboratoire de modèles de pointe ou d’un organisme spécialisé en IA appliquée avancée

  • Un solide palmarès de publications dans des revues de référence en ML ou en IA

  • Expérience en recherche sur l’alignement, l’apprentissage par préférence ou l’IA agentique

  • Expérience dans le déploiement ou le support de systèmes d’IA en production

  • Connaissance des infrastructures de formation à grande échelle et des compromis en matière de calcul

Le candidat idéal

Au cours de la première année, le succès se mesure comme suit :

  • Les modèles post-entraînés présentent des améliorations mesurables en termes de fiabilité, d'alignement, de qualité du raisonnement et d'utilité dans le domaine

  • Les indicateurs d'évaluation et les critères de mise en production sont reconnus et adoptés par toutes les équipes

  • L'équipe produit des recherches de haute qualité ayant un impact concret — et les membres de l'équipe deviennent des chercheurs plus solides et plus autonomes

  • La direction s'appuie sur votre jugement pour évaluer l'état de préparation des modèles, définir l'orientation technique et évaluer les risques

  • Autodesk AI Lab renforce sa réputation en tant que contributeur majeur à la recherche de pointe en IA

Learn More

About Autodesk

Welcome to Autodesk! Amazing things are created every day with our software – from the greenest buildings and cleanest cars to the smartest factories and biggest hit movies. We help innovators turn their ideas into reality, transforming not only how things are made, but what can be made.

We take great pride in our culture here at Autodesk – it’s at the core of everything we do. Our culture guides the way we work and treat each other, informs how we connect with customers and partners, and defines how we show up in the world.

When you’re an Autodesker, you can do meaningful work that helps build a better world designed and made for all. Ready to shape the world and your future? Join us!

Salary transparency

Salary is one part of Autodesk’s competitive compensation package. For Canada based roles, we expect a starting base salary between $0 and $0. Offers are based on the candidate’s experience and geographic location, and may exceed this range. In addition to base salaries, our compensation package may include annual cash bonuses, commissions for sales roles, stock grants, and a comprehensive benefits package.

Diversity & Belonging
We take pride in cultivating a culture of belonging where everyone can thrive. Learn more here:

Are you an existing contractor or consultant with Autodesk?

Please search for open jobs and apply internally (not on this external site).

Create a job alert for this search

Research Lead / Principal Scientist & Manager Post-Training · Alignment · Reinforcement Learning Autodesk AI Lab: Toronto · Remote (CA) • Montreal, QC, CAN

Similar jobs

Hybrid Montreal: Applied AI Research Scientist

Industry ProfessionalsMontreal (administrative region), QC, CA
Full-time

A leading innovator in AI based in Montreal is looking for an Applied AI Research Scientist to join their multidisciplinary team.The ideal candidate should hold a Ph.Master's degree along with subs... Show more

 • Promoted

GenAI Tech Lead — Product‑Driven AI Leadership

NovistoMontreal (administrative region), QC, CA
Full-time

An innovative tech company in Montreal is seeking a GenAI Tech Lead to drive their GenAI initiatives.The successful candidate will have over 8 years of experience in AI/ML projects, with leadership... Show more

 • Promoted

Director, Technical PM — Life Sciences, GCP AI

XebiaMontreal (administrative region), QC, CA
Full-time

A technology consultancy is seeking a Technical Product Manager with substantial experience in life sciences and R&D platforms.This fully remote role entails owning the product strategy, translatin... Show more

 • Promoted

Hybrid Principal Data Scientist Role

IntactMontreal (administrative region), QC, CA
Full-time

Join Intact as a Principal Data Scientist, where you will utilize machine learning to influence key business decisions in a hybrid working environment.Drive innovation with your data expertise.The ... Show more

 • Promoted

AI Research Scientist in Hybrid Role

RecursionMontreal-Ouest
Full-time

Join Valence Labs as an AI Research Scientist, where you will merge research with engineering to advance drug discovery through innovative machine learning techniques.This hybrid position at Recurs... Show more

 • Promoted

AI Lead

Super.comMontreal (administrative region), QC, CA
Full-time

This range is provided by Super.Your actual pay will be based on your skills and experience — talk with your recruiter to learn more.For our employees, our promise is that Super.We are more than a ... Show more

 • Promoted

Principal Scientist – Epitaxial Growth

OmniplyMontreal (administrative region), QC, CA
Full-time

Job Title: Principal Scientist – Epitaxial Growth.Experience: 2+ years industry experience.Omniply is a Montreal-based startup with a revolutionary manufacturing technology for making flexible elec... Show more

 • Promoted

Applied AI Research Scientist — Multimodal Evaluation

MillionLogicsMontreal (administrative region), QC, CA
Full-time

A global IT solutions provider is searching for skilled Applied AI Research Scientists to contribute to AI system evaluations.Candidates should hold an MS or Ph.The role involves designing rigorous... Show more

 • Promoted

AI Team Lead: Strategy, Mentorship & Impact

M-FilesMontreal (administrative region), QC, CA
Full-time

A global technology enterprise in Fredericton is seeking an experienced AI Team Manager to lead and grow a team focused on delivering scalable AI capabilities.This role combines technical leadershi... Show more

 • Promoted

Remote Part-Time AI Research Scientist — STEM PhD

Call For ReferralMontreal (administrative region), QC, CA
Remote
Part-time

A leading global AI research initiative is seeking a Postdoctoral Research Scientist to engage STEM PhD experts for a high-impact project.This fully remote part-time role offers $55–$70 USD per hou... Show more

 • Promoted

Senior Machine Learning Scientist - AI Focus

SAP SEmontreal (administrative region), qc, Canada
Full-time

Join our team as a Senior Machine Learning Engineer, leading the charge on innovative AI systems.You will leverage your experience in scalable ML and complex data models.As a Senior Machine Learnin... Show more

 • Promoted

Innovative Technical Partnerships Manager for AI-Driven Discoveries

FirstPrinciplesMontreal (administrative region), QC, CA
Full-time

Shape the future as a Technical Partnerships Manager, building strategic alliances that support pioneering research in AI and physics.Drive collaboration with top technology partners and enhance re... Show more

 • Promoted

Lead Machine Learning Researcher with Borealis AI

Borealis AIMontreal (administrative region), QC, CA
Full-time

Harness your expertise to revolutionize AI at Borealis AI as a Senior Machine Learning Researcher.Engage with vast data sets and develop advanced algorithms that set industry standards.Join Boreali... Show more

 • Promoted

Remote Lead Scientist & Analytical PM – Gene Therapy

Biolink360Montreal (administrative region), QC, CA
Remote
Full-time

An innovative company dedicated to gene therapy is seeking an Analytical Project Manager to lead vital projects in the development of transformative therapies.This remote role offers the opportunit... Show more

 • Promoted

Senior ML Research Scientist

LawZeroMontreal, Montreal (administrative region), CA
Full-time

We are seeking a Senior Machine Learning (ML) Research Scientist to join our team working on a novel AI safety agenda.In this role, you will design and implement innovative ML models aimed at solvi... Show more

 • Promoted

Shape the Future of AI/ML with High-Impact Research Queries

Great Value HiringMontreal (administrative region), QC, CA
Full-time

Engage as a pivotal AI/ML Research Expert by identifying game-changing questions in your field.Your work could lead to groundbreaking breakthroughs we need to tackle today.This role is crafted for ... Show more

 • Promoted

Applied AI Research Engineer (LLMs & Agentic Systems)

IC ResourcesMontreal, Montreal (administrative region), CA
Full-time

A growing AI company in Montreal is seeking a Research Engineer to bridge research and engineering.The role involves prototyping AI methods, evaluating optimization approaches, and writing producti... Show more

 • Promoted

Remote Data Analytics Scientist – AI & Dashboards

Handis Consulting Inc.Montreal (administrative region), QC, CA
Remote
Full-time

A consulting firm is seeking a Data Analytics Specialist for a one-year full-time contract in Edmonton, Canada.The role involves providing leadership on data initiatives, engaging with internal and... Show more

 • Promoted

Research Scientist, Virtual Cell Modelling & Perturbative Biology Foundation Models

Valence LabsMontreal
Full-time

Valence Labs is Recursion’s frontier AI research engine.We lead high-impact research programs designed to materially expand Recursion’s ability to discover and develop medicines for complex disease... Show more

 • Promoted

Senior Manager, Machine Learning & Applied Science

LoopioMontreal (administrative region), QC, CA
Full-time

We’re seeking a highly skilled and hands-on Senior Manager of Machine Learning & Applied Science to lead the design, development, and delivery of advanced NLP, LLM, and agent-based systems that pow... Show more