Jalons de l'intelligence artificielle
L'histoire de l'intelligence artificielle ne se déroule pas comme une ascension régulière, mais par vagues : grandes promesses, déceptions amères, longues traversées du désert, percées inattendues. Onze étapes suffisent à en comprendre la courbe.
Les années fondatrices
1950 : Turing pose la question autrement
Au lieu de demander si les machines peuvent penser, Alan Turing demande si une machine peut mener une conversation de telle sorte qu'un être humain ne la distingue pas d'un être humain.1 La question de la vie intérieure est remplacée par une question de comportement. Ce tour de force marque le débat jusqu'à aujourd'hui.
1956 : la discipline reçoit son nom
Lors d'un atelier d'été au Dartmouth College, John McCarthy propose le terme « artificial intelligence ». Les participants sont convaincus de résoudre l'essentiel des problèmes en quelques années. Cette erreur d'appréciation se répète à chaque génération.
1958 : le perceptron apprend
Frank Rosenblatt construit une machine qui apprend à partir d'exemples au lieu de suivre des règles : le perceptron, ancêtre de tous les réseaux de neurones. La presse rapporte avec enthousiasme l'arrivée prochaine d'une machine qui marchera, parlera et aura conscience d'elle-même.
1966 : ELIZA et la crédulité
Joseph Weizenbaum programme un agent conversationnel qui imite un psychothérapeute en renvoyant les affirmations sous forme de questions. Le programme fait quelques pages et ne comprend rien. Les personnes testées lui confient malgré tout des choses intimes. Weizenbaum en est si effrayé qu'il devient le critique le plus connu de la discipline.2
Le désenchantement
1969 : les limites du perceptron
Marvin Minsky et Seymour Papert montrent mathématiquement ce que des perceptrons simples ne peuvent pas apprendre par principe.3 Les crédits de recherche se tarissent, le domaine plonge dans le premier « hiver de l'IA ». Un second suit à la fin des années 1980, lorsque les coûteux systèmes experts de l'industrie ne tiennent pas leurs promesses.
1986 : les réseaux apprennent en profondeur
David Rumelhart, Geoffrey Hinton et Ronald Williams popularisent une méthode qui permet d'entraîner aussi des réseaux à plusieurs couches : la rétropropagation de l'erreur.4 L'objection de Minsky est ainsi techniquement levée. Il ne manque plus que les données et la puissance de calcul pour le démontrer. Cela prendra 26 ans.
La percée
1997 : Deep Blue bat Kasparov
Un calculateur d'IBM l'emporte sur le champion du monde d'échecs en titre. Il le fait par la force brute du calcul et par un savoir échiquéen programmé, non par apprentissage. L'événement est plus fort symboliquement que techniquement.
2012 : AlexNet remporte le concours d'images
Un réseau de neurones profond remporte le concours ImageNet avec une telle avance que toute la discipline bascule en deux ans. La raison du succès n'est pas dans des idées nouvelles, mais dans les cartes graphiques et des millions d'images étiquetées. C'est ici que commence le présent.
2016 : AlphaGo et le coup insolite
Un système de DeepMind bat l'un des meilleurs joueurs de go du monde. Le go passait pour hors d'atteinte parce qu'il ne se laisse pas calculer exhaustivement. Le coup 37 de la deuxième partie devient célèbre : un coup qu'aucun humain n'aurait joué et que les spécialistes ont d'abord pris pour une erreur. Il gagne la partie.
2017 : le transformeur
Un groupe de chercheurs de Google présente une nouvelle architecture de réseau qui traite en parallèle les relations entre les mots à l'échelle de textes entiers.5 Elle est le fondement technique de pratiquement tous les modèles de langue actuels. L'article compte parmi les plus cités de l'informatique.
2022 : l'IA devient publique
Avec la mise à disposition de ChatGPT, un modèle de langue devient pour la première fois utilisable par des millions de personnes sans compétence spécialisée. Techniquement, c'est une étape intermédiaire ; socialement, c'est la véritable rupture. Depuis, l'IA n'est plus discutée par les seuls spécialistes, mais par les écoles, les tribunaux, les rédactions et les législateurs.
Ce que montre la courbe
Trois motifs se répètent. Premièrement : des décennies séparent souvent une idée de son effet, parce que les conditions manquent. Deuxièmement : les sauts viennent rarement d'une théorie nouvelle, mais de plus de données et de plus de puissance de calcul. Troisièmement : jusqu'ici, chaque euphorie a été suivie d'un désenchantement. Qui connaît les jalons lit les promesses actuelles avec le calme qui convient.