Base Career helps you apply smarter for this job.
Key skills for this role
We are seeking a Senior AI Developer to join our computer vision (CV) Engineering team in Montreal, QC. In this role, you will design, build, and operate the cloud infrastructure, deployment systems, and supporting services that power our next generation of multi-modal models and reasoning agents.
This role is focused on productionizing LLMs, VLMs, and multi-modal reasoning systems for millions of active users. You will own the infrastructure and operational foundations for deploying, scaling, validating, monitoring, and continuously improving these systems in production. This includes model serving architectures, agent orchestration services, evaluation and validation pipelines, telemetry, observability, and developer tooling.
You will work closely with ML scientists, CV engineers, platform engineers, and SRE partners to translate advanced research systems into secure, reliable, and scalable product capabilities. This role offers an exciting opportunity to help expand the scope of the CV Engineering team into cloud-native deployment of frontier models and reasoning agents.
We are seeking a Senior AI Developer to join our computer vision (CV) Engineering team in Montreal, QC. In this role, you will design, build, and operate the cloud infrastructure, deployment systems, and supporting services that power our next generation of multi-modal models and reasoning agents.
This role is focused on productionizing LLMs, VLMs, and multi-modal reasoning systems for millions of active users. You will own the infrastructure and operational foundations for deploying, scaling, validating, monitoring, and continuously improving these systems in production. This includes model serving architectures, agent orchestration services, evaluation and validation pipelines, telemetry, observability, and developer tooling.
You will work closely with ML scientists, CV engineers, platform engineers, and SRE partners to translate advanced research systems into secure, reliable, and scalable product capabilities. This role offers an exciting opportunity to help expand the scope of the CV Engineering team into cloud-native deployment of frontier models and reasoning agents.
Skip the repetitive application forms
Install the Base Career Chrome Extension and autofill job applications across major job boards with your profile.
Trusted by over 500,000 job seekers on Base Career
More from this employer
, USA
San Francisco, USA
San Francisco, USA
, USA
, USA
San Francisco, USA
, USA
, USA
, USA
We believe that remote work and in-person work have their own advantages and disadvantages, and we want to be able to leverage the best of both worlds. Employees in hybrid roles are required to be in the office 3 days/week.
Deploy and Operate Multi-Modal Models at Scale: Build and maintain production systems for serving LLMs, VLMs, and other multi-modal models with high reliability, low latency, and cost efficiency.
Build Validation and Evaluation Systems: Work with ML Scientists and QA to create robust offline and online evaluation pipelines for reasoning quality, model behavior, hallucination risk, policy compliance, latency, and regression detection.
Validate and Monitor Quality: Ensure reasoning systems are working as expected in long tail cases in-the-wild, ensuring that exceptions are caught early.
Develop Reasoning Agent Infrastructure: Work with other engineers and SRE to develop the orchestration, state management, tool execution, guardrails, and supporting backend services and infrastructure required to run reasoning agents safely and effectively in production.
Establish Telemetry and Observability: Design dashboards, traces, logs, alerts, and performance analytics for model inference and agent workflows using modern monitoring platforms.
Improve Reliability, Performance, and Cost: Optimize throughput, capacity, fallback behavior, model routing, and infrastructure utilization to support millions of active users.
Adopt and Evangelize Best Practices: Evaluate emerging tools, frameworks, and deployment patterns for LLM and agent ops, and help the team standardize on effective practices.
Ensure Security and Compliance: Implement security controls, access patterns, and operational safeguards that protect user data and support responsible production use of generative AI systems.
At Hinge Health, we’re using technology to scale and automate the delivery of healthcare – starting with musculoskeletal (MSK) conditions, which affect over 1.7 billion people worldwide. With an AI-powered, human-centered care model, Hinge Health leverages cutting-edge technology to improve outcomes, experiences, and costs to help people move beyond their pain.
Our platform addresses a broad spectrum of MSK care – from acute injury, to chronic pain, to post-surgical rehabilitation – through personalized, evidence-based care. As the preferred partner to 50+ health plans, PBMs, and other ecosystem partners, Hinge Health is available to over 20 million people across more than 2,550 employers. The company is headquartered in San Francisco with additional offices in Montreal and Bangalore. Learn more at www.hingehealth.com .
Inclusive healthcare and benefits: Comprehensive medical, dental, and vision coverage, with additional support for gender-affirming care, family and fertility planning, and travel reimbursements where care isn’t locally accessible.
Planning for the future: Traditional and Roth 401(k) options with a 2% company match.
Modern life stipends: Flexible stipends to support your learning, development, and modern life needs.
Hinge Health is an equal opportunity employer and prohibits discrimination and harassment of any kind. We make employment decisions without regard to race, color, religion, sex, sexual orientation, gender identity, national origin, age, veteran status, disability status, pregnancy, or any other basis protected by federal, state, or local law. We also consider qualified applicants regardless of criminal histories, consistent with legal requirements.
We provide reasonable accommodations for candidates with disabilities. If you need assistance or an accommodation due to a disability, please let your recruiter know. By submitting your application, you acknowledge that we will use your personal data as outlined in our personnel and candidate privacy policy .
Nous sommes à la recherche d’une personne développeuse principale en IA pour se joindre à notre équipe d’ingénierie en vision par ordinateur (CV) à Montréal, au Québec. Dans ce rôle, vous concevrez, développerez et exploiterez l’infrastructure infonuagique, les systèmes de déploiement et les services de soutien qui propulsent notre prochaine génération de modèles multimodaux et d’agents de raisonnement.
Ce rôle est axé sur la mise en production de grands modèles de langage (LLM), de modèles de vision et de langage (VLM) ainsi que de systèmes de raisonnement multimodaux pour des millions de personnes utilisatrices actives. Vous serez responsable de l’infrastructure et des fondations opérationnelles nécessaires au déploiement, à la mise à l’échelle, à la validation, à la surveillance et à l’amélioration continue de ces systèmes en production. Cela comprend les architectures de service des modèles, les services d’orchestration des agents, les pipelines d’évaluation et de validation, la télémétrie, l’observabilité et les outils pour les développeuses et développeurs.
Vous travaillerez en étroite collaboration avec des scientifiques en apprentissage automatique, des ingénieures et ingénieurs en vision par ordinateur, des ingénieures et ingénieurs de plateforme ainsi que des partenaires SRE afin de transformer des systèmes de recherche avancés en fonctionnalités de produit sécurisées, fiables et évolutives. Ce poste offre une occasion stimulante de contribuer à élargir le mandat de l’équipe d’ingénierie en vision par ordinateur pour y inclure le déploiement infonuagique de modèles de pointe et d’agents de raisonnement
Nous croyons que le travail à distance et le travail en personne comportent chacun leurs avantages et leurs inconvénients. Nous voulons tirer le meilleur parti des deux approches. Les personnes occupant un poste hybride doivent travailler au bureau trois jours par semaine.
Déployer et exploiter des modèles multimodaux à grande échelle : concevoir et maintenir des systèmes de production permettant de servir des LLM, des VLM et d’autres modèles multimodaux avec un haut niveau de fiabilité, une faible latence et une utilisation efficace des coûts.
Concevoir des systèmes de validation et d’évaluation : collaborer avec les scientifiques en apprentissage automatique et l’équipe d’assurance qualité afin de créer des pipelines robustes d’évaluation hors ligne et en ligne pour la qualité du raisonnement, le comportement des modèles, le risque d’hallucination, la conformité aux politiques, la latence et la détection des régressions.
Valider et surveiller la qualité : vous assurer que les systèmes de raisonnement fonctionnent comme prévu dans les cas atypiques et les scénarios à longue traîne en conditions réelles, afin que les exceptions soient détectées rapidement.
Développer l’infrastructure des agents de raisonnement : travailler avec d’autres ingénieures et ingénieurs ainsi qu’avec l’équipe SRE pour développer l’orchestration, la gestion de l’état, l’exécution des outils, les garde-fous et les services backend et l’infrastructure de soutien nécessaires pour exécuter des agents de raisonnement de façon sécuritaire et efficace en production.
Mettre en place la télémétrie et l’observabilité : concevoir des tableaux de bord, des traces, des journaux, des alertes et des analyses de performance pour l’inférence des modèles et les flux de travail des agents à l’aide de plateformes modernes de surveillance.
Améliorer la fiabilité, la performance et les coûts : optimiser le débit, la capacité, le comportement de reprise, le routage des modèles et l’utilisation de l’infrastructure afin de soutenir des millions de personnes utilisatrices actives.
Adopter et promouvoir les pratiques exemplaires : évaluer les outils, les cadres de développement et les modèles de déploiement émergents pour l’exploitation des LLM et des agents, et aider l’équipe à normaliser les pratiques efficaces.
Assurer la sécurité et la conformité : mettre en œuvre des contrôles de sécurité, des modèles d’accès et des mesures de protection opérationnelles qui protègent les données des personnes utilisatrices et favorisent une utilisation responsable des systèmes d’IA générative en production.
Chez Hinge Health, nous utilisons la technologie pour déployer et automatiser les soins de santé à grande échelle, en commençant par les troubles musculosquelettiques (MSK), qui touchent plus de 1,7 milliard de personnes dans le monde. Grâce à un modèle de soins alimenté par l’IA et centré sur la personne, Hinge Health mise sur une technologie de pointe pour améliorer les résultats, l’expérience et les coûts des soins afin d’aider les gens à aller au-delà de leur douleur.
Notre plateforme couvre un large éventail de soins MSK, des blessures aiguës à la douleur chronique, en passant par la réadaptation postopératoire, grâce à des soins personnalisés fondés sur des données probantes. À titre de partenaire privilégié de plus de 50 régimes d’assurance maladie, gestionnaires de prestations pharmaceutiques et autres partenaires de l’écosystème, Hinge Health est accessible à plus de 20 millions de personnes dans plus de 2 550 entreprises. L’entreprise a son siège social à San Francisco et possède également des bureaux à Montréal et à Bangalore. Pour en savoir plus, consultez www.hingehealth.com .
Soins de santé et avantages sociaux inclusifs : couverture complète des soins médicaux, dentaires et de la vue, avec un soutien additionnel pour les soins d’affirmation de genre, la planification familiale et les traitements de fertilité, ainsi que le remboursement des frais de déplacement lorsque les soins ne sont pas accessibles localement.
Préparer l’avenir : Commencez à épargner pour la retraite avec notre régime REER, avec une contribution équivalente de l'employeur de 2 %..
Allocations pour la vie moderne : allocations flexibles pour soutenir votre apprentissage, votre développement et vos besoins du quotidien.
Hinge Health est un employeur qui souscrit au principe de l’égalité des chances et interdit toute forme de discrimination et de harcèlement. Nous prenons nos décisions d’emploi sans égard à la race, à la couleur, à la religion, au sexe, à l’orientation sexuelle, à l’identité de genre, à l’origine nationale, à l’âge, au statut d’ancien combattant, à la situation de handicap, à la grossesse ou à tout autre motif protégé par les lois fédérales, étatiques ou locales. Nous examinons également les candidatures de personnes qualifiées, quels que soient leurs antécédents judiciaires, conformément aux exigences légales.
Nous offrons des mesures d’adaptation raisonnables aux personnes candidates en situation de handicap. Si vous avez besoin d’aide ou d’une mesure d’adaptation en raison d’un handicap, veuillez en informer votre personne recruteuse. En soumettant votre candidature, vous reconnaissez que nous utiliserons vos données personnelles conformément à notre Politique de confidentialité du personnel et des personnes candidates .
Public digital MSK clinic using AI, wearable technology, and clinicians to treat joint and muscle pain.
Visit company websiteJobs and hiring trendsCAD 136800-205200 yearly / year
Full-time
Senior · 3+ years experience
Hybrid
Apply faster on company sites with our extension.