×
Register Here to Apply for Jobs or Post Jobs. X

Spécialiste principal de la plateforme, Laboratoire d'IA Souveraine

Job in Montreal, Montréal, Province de Québec, Canada
Listing for: MILA
Full Time position
Listed on 2026-10-06
Job specializations:
  • IT/Tech
    Cloud Computing: Infrastructure & Operations, AI Engineer (Applied/Software), Information Security & Data Protection, Data Engineering
Job Description & How to Apply Below
Location: Montreal

À propos de Mila

Fondé par le professeur Yoshua Bengio de l’Université de Montréal, Mila rassemble des chercheurs spécialisés en intelligence artificielle et plus précisément en apprentissage automatique, apprentissage profond et apprentissage par renforcement. Reconnu mondialement pour ses importantes contributions au domaine de l’apprentissage profond, Mila s’est particulièrement distingué dans la modélisation du langage, la traduction automatique, la reconnaissance d’objets et les modèles génératifs. Depuis 2017, Mila est le fruit d’une collaboration entre l’Université de Montréal et l’Université McGill, en lien étroit avec Polytechnique Montréal et HEC Montréal.

Mila s’est donné pour mission d’être un pôle mondial d’avancées scientifiques qui inspire l’innovation et l’essor de l’intelligence artificielle (IA) au bénéfice de tous.

Pour en connaitre davantage, veuillez consulter

Sommaire du poste

Le Laboratoire d'IA Souveraine est une nouvelle initiative de Mila visant à assembler une pile (stack) d'inférence IA open source et prête pour les entreprises, que les organisations peuvent déployer et exploiter sur des infrastructures qu'elles contrôlent. Elle regroupe des fonctionnalités telles que le service de modèles, la recherche d'information, l'orchestration d'agents, l'observabilité et un plan de contrôle pour gérer ces composants comme un produit cohérent.

Relevant du directeur principal du dévellopement logiciel , vous concevrez et maintiendrez à jour des paquets de déploiement et d'automatisation pour la pile. Ces paquets et automatisations permettent aux partenaires de déployer, mettre à niveau et restaurer la pile sur leur propre infrastructure, d'un simple nœud jusqu'à des grappes Kubernetes de production. Vous travaillerez avec l'équipe d'intégration pour paqueter leurs composants et les déployer dans des environnements de référence via des flux de travail partagés.

Vous recommanderez des technologies de plateforme basées sur des tests reproductibles, des exigences opérationnelles et l'adéquation à l'architecture. Ce rôle ne comporte pas de garde sur appel.

Le succès signifie que les partenaires peuvent déployer, mettre à niveau, restaurer et exploiter la pile de manière autonome dans les environnements pris en charge, en utilisant des automatisations et des guides d'utilisation vérifiés.

Principales responsabilités

  • Concevoir et maintenir l'infrastructure-code pour les environnements pris en charge. Documenter les exigences matérielles et d'infrastructure.
  • Évaluer les technologies de plateforme open-source par le biais de tests et de bancs d'essai reproductibles. Consigner les méthodes, les résultats, les limites et les risques de maintenance. Recommander des options.
  • Créer et maintenir des packages de déploiement versionnés et des flux de travail partagés avec l'équipe d'intégration. Automatiser l'installation, la configuration, les mises à niveau, les retours en arrière, les sauvegardes et les restauations.
  • Construire et gérer l'infrastructure d'intégration continue (CI) et des environnements de référence reproductibles. Automatiser les tests de publication sur l'ensemble des environnements pris en charge et enregistrer les résultats.
  • Mettre en place et tester les contrôles de sécurité et les paramètres sécurisés par défaut de la plateforme. Tester les mises à jour de sécurité avant de les intégrer aux versions. Fournir des guides de procédures testés pour permettre aux partenaires de connecter leurs systèmes d'identité et d'accès.
  • Connecter la télémétrie de l'infrastructure aux services d'observabilité de la pile. Paqueter les tableaux de bord et les alertes de la plateforme.
  • Tester la fiabilité, les performances, la capacité et l'utilisation des ressources de la plateforme par…
  • To View & Apply for jobs on this site that accept applications from your location or country, tap the button below to make a Search.
    (If this job is in fact in your jurisdiction, then you may be using a Proxy or VPN to access this site, and to progress further, you should change your connectivity to another mobile device or PC).
     
     
     
    Search for further Jobs Here:
    (Try combinations for better Results! Or enter less keywords for broader Results)
    Location
    Increase/decrease your Search Radius (miles)
    0
    200
    Filters
    Education Level
    Experience Level (years)
    Posted in last:
    Salary