Doctorant F/H Étude des plateformes dédiées à l'expérimentation des systèmes distribués: usages et exploitation
Contract type : Fixed-term contract
Level of qualifications required : Graduate degree or equivalent
Fonction : PhD Position
About the research centre or Inria department
Le Centre Inria de l’Université Grenoble Alpes, regroupe un peu moins de 600 personnes réparties au sein de 23 équipes de recherche et 9 services support à la recherche.
Son effectif est distribué sur 3 campus à Grenoble, en lien étroit avec les laboratoires et les établissements de recherche et d'enseignement supérieur (Université Grenoble Alpes, CNRS, CEA, INRAE, …), mais aussi avec les acteurs économiques du territoire.
Présent dans les domaines du calcul et grands systèmes distribués, logiciels sûrs et systèmes embarqués, la modélisation de l’environnement à différentes échelles et la science des données et intelligence artificielle, le Centre Inria de l’Université Grenoble Alpes participe au meilleur niveau à la vie scientifique internationale par les résultats obtenus et les collaborations tant en Europe que dans le reste du monde.
Context
Les plateformes dédiées à l'expérimentation comme Grid'5000 [1] et Chameleon [2] ont largement prouvé leur capacité à supporter la réalisation reproductibles d'expériences d'envergure pour les systèmes distribués (Cloud, HPC et Continum). Néanmoins il est à noter que de nombreuses difficultés demeurent que cela soit dans leurs usages et leurs exploitations.
Pour les usages, c'est-à-dire la réalisation et la conduite d'expériences, nous avons identifié [3] des classes de difficulté, ou frictions, qui apparaissent naturellement dans la répétition des expériences et l'évolution des besoins qui se traduisent généralement dans une montée en complexité difficile à maîtriser. Ces frictions impliquent de réanalyser et le cas échéant faire évoluer les méthodes et outils de conduites d'expériences voire d'introduire de nouvelles abstractions pour garder une bonne maîtrise du déroulé expérimental.
Pour les difficultés associées à l'exploitation de ce type de plateformes, c'est un sujet qui reste peu étudié. Une plateforme comme Grid'5000 est un objet complexe il en va de même des plateformes de moindre envergure. En première analyse il apparaît que mettre en place une plateforme pour l'expérimentation représente un effort conséquent. Ce point est problématique car de nombreuses équipes de recherches amorcent des études expérimentales en composant des plateformes d'expérimentation autours d'équipement spécifiques sans maîtriser les méthodes et services nécessaires pour un accès partager et un contrôle propre des processus expérimentaux. Cela conduite généralement soit à des limitations soit à une augmentation des frictions dans leurs usages. La qualité des résultats expérimentaux et leurs analyses peut alors en être directement impactée.
Dans cette thèse, nous nous intéressons à traiter ces 2 axes précédents en considérer l'usage de l'approche par Functional Package Manager (FPM) [4].
Il s'agit notamment de profiter de leur garantie de reproductibilité et de leur capacité de composabilité. Dans [5] nous avons montrer que leur usage est particulièrement pertinent pour exprimer des piles logicielles complexes de systèmes distribués à des fins d'expérimentation, ici les objets directs d'études ne seront plus des expériences de systèmes distribués mais les plates-formes dédiées à l'expérimentation.
References:
[1] Bolze, Raphaël, et al. "Grid'5000: a large scale and highly reconfigurable experimental grid testbed." The International Journal of High Performance Computing Applications 20.4 (2006): 481-494.
[2] Keahey, Kate, et al. "Lessons learned from the chameleon testbed." 2020 USENIX annual technical conference (USENIX ATC 20). 2020.
[3] Amine Salmane; Yifei Sun; Hugo Brunie and Olivier Richard "Some Lessons learnt on FPM promises with NixOS-Compose."
2026 1ˢᵗ Workshop in Sustainable Practices for Reproducibility in HPC, ISC26 - 2026.
[4] Dolstra, Eelco. The purely functional software deployment model. Utrecht University, 2006.
[5] Guilloteau, Quentin, et al. "Painless transposition of reproducible distributed environments with nixos compose." 2022 IEEE International Conference on Cluster Computing (CLUSTER). IEEE, 2022. Xiaohua Zhai et al., Scaling Vision Transformers, IEEE/CVF CVPR, 2022
Assignment
Nous recherchons un(e) étudiant(e) talentueux(se) et passionné(e) pour rejoindre notre équipe de recherche en calcul haute performance (HPC). L'objectif est d'explorer et de proposer des méthodologies ainsi que des outils permettant de maîtriser l'expérimentation sur des systèmes distribués, et d'aider aux développements et à l'exploitation des futures plate-formes dédiées à l'expérimentation.
Main activities
Le/la doctorant(e) se concentrera sur les axes suivants :
1. Étude comparée et critique des plate-formes dédiées à l'expérimentation :
- Il n'existe pas à notre connaissance d'étude critique récente des principales plate-formes dédiées à l'expérimentation, c'est un préalable pour assurer les propositions de ces travaux de thèse.
2. Identification et formalisation des problématiques de frictions pour la réalisation d'expériences:
- En partant des premiers travaux réalisés [3], il s'agira à la fois d'étendre le catalogue des frictions survenant lors de la conduite d'expérimentations complexes, et de proposer un cadre de réflexion formel pour traiter les problématiques qui leurs sont spécifiques.
3. Développement d'une couche d'abstraction pour la simplification des expérimentations :
- Après la formalisation des problématiques liées aux expériences complexes, il s'agira de développer un atelier logiciel profitant des atouts propres aux Functional Package Managers (FPM)
- Application aux expériences du projet Numpex PC Exa-Atow
4. Définition et développement de plate-formes déclaratives et reproductibles dédiées à l'expérimentation
- Il s'agit avec l'aide de l'approche par FPM de définir, une classe de plate-formes qui puisse être déployer en partant d'une approche déclarative. Les différents cycles d'exploitation devront être pris en compte (par exemples: intégration continue, mise à jour, monitoring, traitement de pannes...).
- De la précédente définition plusieurs prototypes seront réalisés et évalués.
Skills
Mandatory skills (the candidate must have):
Strong knowledge of computer system (system adminstration, network, distributed system)
Strong programming knowledge of Functional and Imperatives languages, and System Tools
Knowledge in formal methods
Languages: proficiency in written English and fluency in spoken English.
Relational skills: the candidate will work in a research team, where regular meetings will be set up. The candidate has to be able to present the progress of their work in a clear and detailed manner.
Other values appreciated: Open-mindedness, strong integration skills, and team spirit.
Benefits package
- Restauration subventionnée
- Transports publics remboursés partiellement
- Congés: 7 semaines de congés annuels + 10 jours de RTT (base temps plein) + possibilité d'autorisations d'absence exceptionnelle (ex : enfants malades, déménagement)
- Possibilité de télétravail (après 6 mois d'ancienneté) et aménagement du temps de travail
- Équipements professionnels à disposition (visioconférence, prêts de matériels informatiques, etc.)
- Prestations sociales, culturelles et sportives (Association de gestion des œuvres sociales d'Inria)
- Accès à la formation professionnelle
- Participation employeur mutuelle santé (sous conditions)
Remuneration
2300 euros brut /mois
General Information
- Theme/Domain :
Distributed and High Performance Computing
System & Networks (BAP E) - Town/city : Grenoble
- Inria Center : Centre Inria de l'Université Grenoble Alpes
- Starting date : 2026-10-01
- Duration of contract : 3 years
- Deadline to apply : 2026-09-30
Warning : you must enter your e-mail address in order to save your application to Inria. Applications must be submitted online on the Inria website. Processing of applications sent from other channels is not guaranteed.
Instruction to apply
Les candidatures doivent être déposées en ligne sur le site Inria.
Le traitement des candidatures adressées par d'autres canaux n'est pas garanti.
Defence Security :
This position is likely to be situated in a restricted area (ZRR), as defined in Decree No. 2011-1425 relating to the protection of national scientific and technical potential (PPST).Authorisation to enter an area is granted by the director of the unit, following a favourable Ministerial decision, as defined in the decree of 3 July 2012 relating to the PPST. An unfavourable Ministerial decision in respect of a position situated in a ZRR would result in the cancellation of the appointment.
Recruitment Policy :
As part of its diversity policy, all Inria positions are accessible to people with disabilities.
Contacts
- Inria Team : DATAMOVE
-
PhD Supervisor :
Richard Olivier / olivier.richard@inria.fr
The keys to success
Vous pouvez donner là, un portrait à "gros traits" du (de la) collaborateur(trice) attendu(e) : ce que vous voyez comme nécessaire et suffisant et qui peut associer :
- goûts et appétences,
- domaine d'excellence,
- éléments de personnalité ou de caractère,
- savoir et savoir faire transversaux...
Cette rubrique permet de compléter et alléger (réduire) la liste plus formelle des compétences :
- "Se sentir à l'aise dans un environnement de dynamique scientifique, aimer apprendre et écouter sont des qualités essentielles pour réussir cette mission."
- " Passionné(e) par l'innovation, avec une expertise dans le développement Ruby on Rail et une grande capacité de conviction. Une thèse dans le domaine *** constitue un réel atout."
About Inria
Inria, the French national institute for research in digital science and technology, supports the French government in national research and innovation strategies in the digital field, acting as Digital Programs Agency. Inria leads over 300 research and innovation projects with its 3,500 scientists, engineers, and support staff, in partnership with universities and the digital ecosystem (businesses, entrepreneurs, and public stakeholders). Together, we explore strategic fields such as artificial intelligence, cybersecurity, quantum computing, cloud technologies, digital transformation in healthcare, digital twins, and digital technologies for defence. We develop practical solutions such as software, tech startups, partnerships with national companies, and cutting-edge training programmes. Our goal is to drive scientific, technological, and industrial excellence to ensure France’s digital sovereignty.