Un chercheur doit simuler le repliement des protéines. Elle se connecte à un terminal, non pas pour utiliser une seule machine, mais pour accéder à un réseau tentaculaire qui gère la charge. Un trader doit prédire les mouvements des stocks. Il récupère les données sur un PDA portable, tirant ainsi l’alimentation de l’infrastructure back-end de son entreprise. Un commandant militaire coordonne une frappe. Il ne s’appuie pas sur une seule batterie de serveurs ; il accède aux ressources de trois réseaux militaires distincts et séparés pour formuler une stratégie.
Ces scénarios ressemblent à de la science-fiction ou à de la fantaisie au niveau de l’entreprise, mais ils pointent tous vers la même architecture sous-jacente : le calcul en grille.
C’est l’équivalent numérique de la mutualisation des ressources. Dans un réseau, vous ne disposez pas seulement de la puissance de votre propre ordinateur. Vous avez accès aux cœurs de traitement, à la mémoire et au stockage de chaque machine autorisée du système. C’est de l’informatique distribuée sous stéroïdes. Le but ? Faire en sorte qu’un réseau d’ordinateurs disparates agisse comme un superordinateur massif et unifié.
Le mythe de la machine unique
Historiquement, si vous aviez besoin de plus de puissance, vous achetiez un ordinateur plus rapide. Vous avez ajouté plus de RAM. Vous avez utilisé un disque dur plus gros. Il y avait un plafond à ce qu’une seule boîte pouvait faire, quel que soit l’argent que vous y consacriez. L’informatique en grille brise ce plafond.
Pensez-y comme à un voyage de camping. Vous partez seul. Vous avez une tente. Votre ami en a un autre. On apporte la nourriture. On amène le SUV. Si vous partez seul, vous devez tout emporter. Vous êtes limité par votre propre force et votre propre équipement. Si vous voyagez ensemble, vous partagez la charge. Vous utilisez les compétences de chacun. Le voyage devient plus facile, plus rapide et plus efficace car aucune personne ne porte tout le fardeau.
Le calcul en grille applique cette logique aux données.
Un ordinateur standard s’appuie sur sa propre unité centrale de traitement (CPU). Ce microprocesseur traite les chiffres et dirige les données. Il s’appuie également sur la mémoire (RAM), qui est un stockage temporaire à haut débit proche du processeur, et sur le stockage (disques durs ou bases de données), qui est permanent mais plus lent. Par défaut, un utilisateur est coincé dans les limites de son propre matériel.
Dans une grille, ces limites disparaissent. Le système relie ces ressources entre elles. Lorsque vous exécutez une requête, la grille n’utilise pas seulement votre CPU. Il achemine une partie de la tâche vers des milliers d’autres machines du réseau. Pour l’utilisateur, c’est comme de la magie. Vous accédez à la puissance collective de l’ensemble du réseau, et pas seulement du silicium devant vous.
Ce n’est pas nouveau, mais ce n’est pas prêt
Voici le problème : le calcul en grille n’est pas une idée nouvelle. Il s’agit d’un type spécifique d’informatique distribuée. L’informatique distribuée existe depuis des décennies, avec différents ordinateurs partageant des ressources sur un réseau. Mais le véritable calcul en grille va plus loin. Dans l’état idéal, chaque ressource est partagée. Chaque cycle de processeur et chaque octet de stockage devient un atout communautaire.
L’accès doit être transparent. L’interface ne doit pas donner l’impression que vous piratez un ordinateur central. Vous devriez avoir l’impression que vous travaillez sur votre propre bureau. La différence réside dans l’ampleur invisible de la puissance en coulisses.
Toutefois, la technologie est loin d’être au point. Nous sommes toujours dans le désordre. Les informaticiens et les ingénieurs sont actuellement aux prises avec des normes et des protocoles. À l’heure actuelle, de nombreux systèmes de grille s’appuient sur des logiciels propriétaires. Ils sont cloisonnés. Si vous souhaitez rejoindre la grille, vous avez souvent besoin d’outils spécifiques et verrouillés par un fournisseur. Tant que l’industrie ne s’est pas mise d’accord sur un ensemble de règles universelles, leur adoption reste difficile. Les organisations hésitent à investir dans des infrastructures qui pourraient ne pas bien fonctionner avec les autres.
Le piège du jargon
Si vous plongez dans la documentation sur le calcul en grille, vous vous noierez sous les acronymes. Le domaine emprunte énormément à d’autres secteurs technologiques. Pour comprendre comment cela fonctionne, vous devez séparer le signal du bruit.
Le calcul en grille est lié à plusieurs autres modèles, et les frontières sont souvent floues :
- Informatique partagée : Il s’agit de la catégorie générale. Il fait référence à tout ensemble d’ordinateurs partageant la puissance de traitement pour accomplir une tâche. C’est un peu générique.
- Utility Computing : Ceci est souvent fourni via Software-as-a-Service (SaaS). Pensez-y comme à l’électricité. Vous ne construisez pas de centrale électrique ; vous vous connectez au réseau et payez ce que vous utilisez. Les entreprises proposent de la puissance de stockage ou de traitement sur une base mesurée.
- Cloud Computing : C’est le terme le plus connu aujourd’hui. Dans le cloud computing, les applications et le stockage « vivent » sur le web. Vous ne possédez pas le matériel ; vous en louez l’accès. Alors que le cloud et la grille partagent leurs racines, la grille se concentre davantage sur la mise en commun des ressources inutilisées pour des tâches de calcul massives, tandis que le cloud se concentre souvent sur la fourniture de services sur Internet.
Pour naviguer dans ces concepts, vous devez connaître le lexique. Voici les bases :
- Cluster : groupe d’ordinateurs en réseau qui partagent des ressources. Ils travaillent ensemble comme une seule unité.
- Nœud : tout appareil sur un réseau pouvant transmettre, recevoir ou rediriger des données. Les nœuds de contrôle gèrent le flux.
- XML (Extensible Markup Language) : Un langage de codage qui décrit les données. Il est lisible par l’homme et par la machine. Les nœuds de contrôle utilisent des dérivés XML tels que WSDL (Web Services Description Language) pour comprendre comment gérer des applications et des types de données spécifiques.
- Hub : Un point central dans un réseau où plusieurs appareils se connectent.
- IDE (Integrated Development Environment) : La boîte à outils que les programmeurs utilisent pour créer des applications.
- Sandbox : Un environnement isolé utilisé pour tester les applications sans risquer le système principal.
La technologie fonctionne. Le concept est solide. Mais la fragmentation des normes reste le principal obstacle. Tant que la « plomberie » du réseau ne sera pas standardisée, nous continuerons à voir des îlots d’énergie isolés plutôt qu’un supercalculateur mondial véritablement unifié.
Le vocabulaire technique
Pour comprendre le calcul en grille, il faut parler la langue. Ce ne sont pas que des mots à la mode ; c’est la façon dont des machines disparates communiquent entre elles.
L’interopérabilité est le fondement. Sans cela, votre PC et votre Macintosh sont des îles. Ils ont des systèmes d’exploitation différents, des architectures différentes. Ils ne peuvent pas travailler ensemble à moins que le logiciel ne comble cet écart.
Ensuite, il y a les normes ouvertes. Les normes exclusives vous enferment dans l’écosystème d’un seul fournisseur. Les normes ouvertes sont publiques. Tout le monde peut les adopter. Cela rend l’intégration beaucoup plus facile car tout le monde joue selon les mêmes règles.
Nous parlons également de traitement parallèle. Il ne s’agit pas seulement d’effectuer plusieurs tâches à la fois sur une seule puce. Il utilise plusieurs processeurs pour résoudre un seul problème informatique. Il est étroitement lié à l’informatique partagée, qui siphonne les ressources inexploitées d’un réseau pour accomplir le travail.
Une plate-forme n’est que la base. Il peut s’agir d’un système d’exploitation, d’une architecture, d’un langage ou même d’un site Web. Les développeurs s’appuient sur cela.
Lorsqu’un seul serveur ne suffit pas, vous avez besoin d’une ferme de serveurs. Un cluster de serveurs travaillant ensemble sur des tâches trop complexes pour une seule machine.
Mais acheter plus de matériel coûte cher. Entrez virtualisation du serveur. Cette technique utilise un logiciel pour découper un seul serveur physique en plusieurs plates-formes virtuelles exclusives. Chaque serveur virtuel exécute son propre système d’exploitation indépendamment. Un boîtier peut héberger simultanément un serveur Linux et un serveur Windows. Cela fonctionne parce que la plupart des serveurs restent inactifs la plupart du temps. La virtualisation réduit les coûts matériels pour les systèmes de grille qui nécessitent des dizaines de nœuds.
Dans cet environnement, un service est tout système logiciel permettant aux ordinateurs d’interagir sur le réseau.
La communication repose souvent sur SOAP (Simple Object Access Protocol). Un ensemble de règles pour échanger des messages XML sur un réseau. Microsoft l’a développé. C’est la syntaxe de la conversation.
La gestion des données nous amène à état. En informatique, l’état correspond à toute donnée persistante. Il survit au cycle de vie de l’application. Lorsque vous déposez des livres dans un panier Amazon, il s’agit de données avec état. Amazon suit votre sélection pendant que vous naviguez. Les services avec état permettent des applications en plusieurs étapes qui s’appuient sur des données de base cohérentes.
Et enfin, éphémère. La possibilité d’activer ou de désactiver un service sur le réseau sans interrompre l’ensemble de l’opération.
Partage de ressources
Alors, comment ces pièces s’articulent-elles ?
Plusieurs organisations s’efforcent de créer des protocoles standardisés. Le but ? Rendre les environnements informatiques en grille plug-and-play.
Les systèmes de grille existent aujourd’hui. Mais la compatibilité est aléatoire. Pourquoi? Parce que chaque système utilise souvent un ensemble unique de protocoles et d’outils. Deux grilles peuvent ne pas communiquer entre elles. Cette absence d’accord constitue le goulot d’étranglement.
Un système informatique en grille fonctionnel nécessite généralement trois choses :
- Un nœud de contrôle. Généralement un serveur gérant les tâches administratives. C’est le répartiteur.
- Un réseau. Ordinateurs exécutant un logiciel de grille spécial. Ceux-ci agissent comme des interfaces utilisateur et des pools de ressources. Le réseau peut être homogène (même OS, même matériel) ou hétérogène (un mélange de tout). Il peut être câblé ou via Internet ouvert.
- Middleware. Le bourreau de travail. Logiciel qui permet à différents ordinateurs d’exécuter un processus sur le réseau. Sans middleware, la communication est impossible. Il n’existe pas de format unique pour le middleware, ce qui ajoute au problème de fragmentation.
Le nœud de contrôle est occupé. Il priorise les tâches. Il planifie le travail sur le réseau. Il décide des ressources dont dispose chaque tâche. Il surveille la surcharge. Il doit surtout garantir que la machine locale de l’utilisateur ne ralentisse pas. La grille devrait exploiter les ressources inutilisées. Si votre ordinateur est en retard lorsque la grille s’exécute, le système est en panne.
Le problème de la normalisation
Le potentiel est illimité. Mais seulement si tout le monde s’accorde sur les protocoles et les outils.
Sans format standard, les développeurs tiers sont bloqués. Les programmeurs indépendants souhaitent créer des applications sur la grille, mais ils ne peuvent pas garantir la compatibilité. Ils devront peut-être créer différentes versions de la même application pour différents systèmes. Cela prend du temps. Les développeurs ne veulent pas faire deux fois le même travail.
Un ensemble de protocoles standardisés permettrait aux développeurs de se concentrer sur un seul format. Une base de code. Une grille.
En attendant, nous sommes coincés dans un paysage fragmenté. Puissant, oui. Mais en désordre.
Ce qui nous ramène à la question : si le matériel et les logiciels existent, pourquoi tous les réseaux ne sont-ils pas une grille ?
Le paradoxe de la sécurité de l’alimentation distribuée
Relier des machines disparates en un seul tissu informatique semble être une solution utopique en termes de puissance de traitement. Ce n’est pas le cas. C’est un casse-tête logistique entouré de risques de sécurité. Lorsque vous connectez deux ordinateurs, sans parler de milliers, vous vous posez des questions sur la confidentialité, le contrôle d’accès et la monopolisation des ressources.
Le middleware est la réponse, ou du moins le pansement actuel. Les protocoles de grille ne résolvent pas ces problèmes en soi ; ils permettent simplement aux développeurs de créer plus facilement les outils qui le font. Le gros souci ? Cryptage.
La plupart des ingénieurs s’appuient sur le cryptage pour assurer la sécurité des données. Vous encodez les informations afin que seules les personnes possédant la clé puissent les lire. Casser ce code nécessite généralement de prendre en compte des nombres énormes dans leurs diviseurs premiers, une tâche qui prend des années à un superordinateur normal. Mais voici l’ironie : un système informatique en grille peut être utilisé comme une arme pour déchiffrer ces mêmes codes. Si suffisamment de processeurs inactifs sont connectés, le temps nécessaire pour briser un cryptage fort passe de plusieurs années à plusieurs jours.
“Un pirate informatique pourrait éventuellement créer un système informatique en grille dans le but de déchiffrer des informations cryptées.”
Les logiciels propriétaires peuvent offrir une légère protection, mais les normes ouvertes, essentielles au fonctionnement des réseaux, laissent les portes grandes ouvertes. Chaque nœud a besoin d’un logiciel spécifique pour interagir avec l’ensemble. Si ce logiciel présente une vulnérabilité, toute la grille saigne.
Ensuite, il y a la question de l’accès. Vous ne pouvez pas laisser tout le monde se déchaîner. Si un utilisateur bloque toutes les ressources, vous vous retrouvez dans une impasse. Le nœud de contrôle se fige. Rien ne se passe. Ainsi, les protocoles d’autorisation et d’authentification deviennent non négociables. Seuls certains utilisateurs bénéficient d’un accès complet au réseau. Tous les autres? Ils récupèrent leur propre machine, moins la puissance supplémentaire.
Qui regarde la vitrine ?
Le middleware et le nœud de contrôle agissent comme des videurs de la grille. Ils gèrent le flux. Ils garantissent qu’aucun ordinateur ne domine le réseau et, à l’inverse, ils garantissent que le réseau ne dépouille pas l’ordinateur personnel d’un utilisateur à chaque dernière goutte de cycles CPU. Si le système vous prive de vos propres ressources informatiques, il n’est pas efficace. C’est hostile.
De la science-fiction au laboratoire
Alors, où va réellement ce pouvoir ? Pas dans vos jeux vidéo. Pas dans vos feuilles de calcul.
La plupart des réseaux opérationnels appartiennent aujourd’hui au monde universitaire et à la recherche. Techniquement, il s’agit de « systèmes informatiques partagés » plutôt que de véritables grilles d’entreprise persistantes. Ils récoltent les cycles inutilisés. Et ils font le gros du travail.
SETI@home : À l’écoute du vide
Le projet Search for Extraterrestrial Intelligence (SETI) a mis le calcul en grille sur la carte. Les radiotélescopes collectent des téraoctets de bruit cosmique. Un seul ordinateur ne peut pas passer au crible cette botte de foin à la recherche d’une aiguille. SETI@home a créé un programme qui transforme des millions d’ordinateurs personnels en un superordinateur virtuel. Vous l’installez. Il se trouve en arrière-plan. Il analyse les données à la recherche de signaux extraterrestres. Si vous voulez jouer à Call of Duty, le logiciel cède. Lorsque vous vous déconnectez, il reprend.
Folding@home : Résoudre le casse-tête des protéines
Ensuite, il y a le Pande Group à Stanford. Ils ne recherchent pas des extraterrestres ; ils recherchent les causes de la maladie de Parkinson et de la maladie d’Alzheimer. La clé est le repliement des protéines. Les protéines prennent des formes spécifiques pour fonctionner. Lorsqu’ils se plient mal, des maladies s’ensuivent.
Folding@home simule la façon dont les protéines se replient. C’est un énorme problème informatique. Le groupe Pande espère qu’en comprenant la physique du mauvais repliement, il pourra trouver de nouveaux traitements. Le processus est identique à SETI : téléchargez l’application, laissez votre processeur inactif pendant la nuit et contribuez à la science médicale.
La nature éphémère de l’informatique volontaire
Il existe des dizaines de ces projets. Beaucoup ne sont pas permanents. Une fois l’objectif de recherche atteint, la grille se dissout. Parfois, un nouveau projet remplace l’ancien. Parfois, cela disparaît.
C’est un modèle fascinant. Vous prêtez vos cycles inactifs à la science. Vous n’obtenez rien d’autre en retour que le sentiment chaleureux et flou de contribuer au SETI ou à la recherche médicale. Le logiciel est conçu avec une faible priorité. Il respecte votre machine. Il s’éteint lorsque vous en avez besoin. Il se réveille quand vous ne le faites pas.
Mais est-ce important ? Si la grille peut être utilisée pour casser le chiffrement, si les contrôles d’accès sont fragiles, si les projets sont temporaires… le risque en vaut-il la chandelle ? Le code est là. Les processeurs sont en ligne. La question est de savoir si nous construisons un outil de découverte ou un botnet en attente.
Une fois que votre ordinateur a fini de calculer les chiffres, le logiciel du projet renvoie ces données au nœud de contrôle. Le nœud le trie et place les résultats dans la bonne base de données. Ensuite, il envoie un nouveau bloc de données à votre machine. Le cycle se répète jusqu’à ce que le travail soit terminé. Si suffisamment de personnes participent, les objectifs ambitieux sont anéantis en un temps étonnamment court.
À mesure que ces systèmes informatiques en grille deviennent plus intelligents, nous verrons de plus en plus d’organisations construire des réseaux polyvalents. Il se pourrait même qu’un jour les entreprises interconnectent directement les unes avec les autres. Dans ce monde, des problèmes informatiques qui semblent impossibles aujourd’hui pourraient être réduits à quelques heures de temps de traitement. Nous devrons simplement attendre et voir.
Succès dans le monde réel : le projet de comparaison du génome
La théorie, c’est bien, mais les résultats sont meilleurs. Prenez le Projet de comparaison du génome comme preuve. Cet effort de recherche visait à comparer les séquences protéiques de plus de 3 500 organismes. Le coup d’envoi a eu lieu le 20 décembre 2006.
Le 21 juillet 2007, le projet avait déjà atteint tous ses objectifs. Il n’avait pas besoin d’une seule ferme de superordinateurs. Il a utilisé un système informatique en grille pour effectuer le gros du travail. C’est le pouvoir des ressources distribuées.
Qu’est-ce que le Grid Computing exactement ?
Les gens confondent souvent cela avec le cloud computing standard. La différence réside dans la portée et le but. Une grille est un réseau d’ordinateurs qui partagent des ressources pour résoudre des problèmes importants et complexes. Il agit comme un supercalculateur virtuel.
Vous pouvez considérer le calcul en grille comme l’exploitation des ressources de plusieurs domaines administratifs pour résoudre un seul problème. Il combine la puissance de nombreux ordinateurs individuels répartis sur un réseau, souvent l’Internet public. Cela le distingue d’un simple cluster, qui reste généralement au sein d’une seule organisation.
Exemples populaires de projets de grille
Pourquoi est-ce important pour vous ? Parce que ces réseaux résolvent des crises réelles. Voici quelques exemples notables :
- SETI@home : utilise la puissance de traitement disponible sur des millions d’ordinateurs personnels pour rechercher la vie extraterrestre. Il transforme les processeurs inactifs en postes d’écoute dans l’espace lointain.
- Folding@home : se concentre sur le repliement des protéines. En étudiant comment les protéines se replient, les chercheurs espèrent mieux comprendre des maladies comme la maladie d’Alzheimer et la maladie de Parkinson.
- World Community Grid : s’attaque aux défis humanitaires. Cela comprend la recherche sur le cancer, les études sur le VIH/SIDA et les initiatives en matière d’énergie propre.
Ces projets montrent comment le calcul en grille transforme le matériel inutilisé en une force au service du bien scientifique. Vous n’avez pas besoin d’être un scientifique pour aider. Vous avez juste besoin d’une connexion Internet et d’un peu de temps libre.
Pourquoi c’est important maintenant
La sophistication de ces systèmes augmente. De plus en plus d’entreprises créeront probablement bientôt des réseaux polyvalents. Nous nous dirigeons vers une ère où les problèmes informatiques sont réduits à des morceaux gérables. Cela démocratise le calcul haute performance. Cela signifie que vous n’avez pas besoin d’une salle de serveurs d’un million de dollars pour exécuter des simulations.
L’infrastructure est déjà là. L’Alliance Globus et l’Open Grid Forum continuent d’affiner les normes. Des entreprises comme IBM investissent depuis longtemps pour rendre accessible l’informatique en grille. Les outils facilitent la collaboration sur Internet pour ces tâches massives.
Regarder vers l’avenir
La prochaine fois que vous verrez votre ordinateur inactif, n’oubliez pas qu’il pourrait faire partie de quelque chose de plus grand. Il pourrait s’agir d’analyser des séquences de protéines ou de scanner les étoiles. La technologie est mature. Les applications se multiplient. Et l’impact est réel.
“Le calcul en grille étend sa portée.”
Les pièces sont en place. La question est de savoir si nous les utiliserons assez rapidement. L’avenir du travail distribué n’arrive pas. Il est déjà là, en arrière-plan de notre vie quotidienne.


























