Accueil / Le livre / Partie 1 / Chapitre 4 : L'océan derrière le miroir — quand l'individu r / Texte intégral
[ texte intégral · chapitre 4 ]

Chapitre 4 : L'océan derrière le miroir — quand l'individu rencontre le collectif

≈ 13 min de lecture · 2,535 mots

Jusqu'ici, nous avons parlé de la relation entre « vous » et le grand modèle de langage. Votre entrée, votre intention, vos biais, vos images latentes. Toutes nos histoires tournaient autour de l'individu.

Mais il nous faut désormais déplacer le regard vers une autre direction.

Avec quel matériau ce miroir est-il fabriqué ?

Pas une base de données : un compresseur de motifs

Les données d'entraînement d'un grand modèle de langage dépassent de loin tout ce qu'un être humain pourrait lire en une vie. L'intégralité des articles de Wikipédia. Des milliards de pages web — dépêches, blogs, fils de forums, discussions sur les réseaux sociaux. Des millions de livres — de Shakespeare au Daodejing, de L'Origine des espèces aux confidences postées sur Reddit en pleine nuit. Des masses d'articles académiques et de bibliothèques de code ouvert. Et quantité d'écrits ordinaires — appels à l'aide, disputes, récits de voyage, journaux intimes rédigés à trois heures du matin. Sans valeur académique, mais qui enregistrent les habitudes langagières et les schémas émotionnels les plus authentiques de l'humanité.

Mais voici un détail technique d'une importance capitale : le grand modèle de langage n'est pas une base de données.

Vous ne pouvez pas lui demander « le texte original du tome III, chapitre VII, des Frères Karamazov ». Une fois l'entraînement achevé, ces données ne sont pas « stockées » dans le modèle sous forme de texte brut. Ce qui se produit réellement : le processus d'entraînement extrait des masses de texte des motifs — cooccurrences entre les mots, régularités syntaxiques, gabarits de raisonnement, rythmes de l'expression émotionnelle, liens de fait à fait — puis encode ces motifs dans des centaines de milliards de poids de paramètres.

Cette compression est avec perte. Dates précises, chiffres, citations sont les premières victimes du procédé — voilà pourquoi le grand modèle de langage « se souvient » souvent de travers des détails. Mais il conserve avec une efficacité stupéfiante l'information structurelle la plus centrale du langage : comment on l'emploie, comment les savoirs se relient, comment un raisonnement se déploie, comment une émotion s'exprime.

Une analogie imparfaite mais utile : passez tous les livres d'une bibliothèque au mixeur. Vous obtenez non des livres reconnaissables, mais une bouillie homogène de « savoir ». Aucun texte original n'en est restaurable ; pourtant cette bouillie concentre la substance nutritive de tous les livres. « Infusez-la » comme il faut — offrez-lui l'entrée appropriée — et elle jaillira en une boisson au parfum particulier, mêlant l'essence des passages pertinents de plusieurs livres sans se confondre avec aucun d'eux.

Quand votre question entre dans cet océan de paramètres

Relions maintenant les acquis des chapitres précédents à celui-ci.

Imaginons qu'une nuit d'insomnie, quelqu'un ouvre le grand modèle de langage et saisisse ces mots :

« J'ai 35 ans. Un travail honorable, maison, voiture, un enfant en bonne santé. Au regard de tous les critères du monde, je devrais être comblé. Mais ces derniers temps, je me mets à trouver que tout est privé de sens. Pas du malheur : un vide plus profond — comme si je passais mon temps à accomplir une liste de tâches écrite par quelqu'un d'autre, sans avoir jamais demandé si cette liste correspondait vraiment à ce que moi, je voulais. »

À l'instant même où ces mots entraient dans le modèle, ils pénétraient sous forme de vecteurs dans l'espace des paramètres. Dans cet espace constitué de centaines de milliards de paramètres, les résidus de motifs des données d'entraînement ci-dessous se trouvèrent activés — notez bien : ce ne sont pas les données d'entraînement elles-mêmes qui sont rappelées, ce sont les motifs qu'elles ont gravés dans les paramètres durant l'entraînement qui s'activent :

Les développements de la littérature psychologique sur la « crise de sens du milieu de vie ». La phase de « générativité vs stagnation » qu'Erikson situe au milieu de l'existence. Les analyses de cas d'Yalom sur la « vacuité existentielle ». Chez les existentialistes, Camus interrogeant l'absurde, Kierkegaard analysant le désespoir — lui qui disait que le désespoir le plus profond n'est pas de ne pas obtenir ce que l'on veut, mais de n'avoir jamais su ce que l'on veut. Les innombrables confidences nocturnes que des gens ordinaires ont postées à deux heures du matin sur Reddit ou Zhihu — peu littéraires, grammaticalement relâchées, mais où se consigne la langue véritable que des êtres réels ont trouvée dans une douleur réelle. Tolstoï, dans La Mort d'Ivan Ilitch, peignant la frayeur d'un homme « honorable » d'âge mûr qui comprend soudain qu'il a vécu toute sa vie sur le scénario d'autrui. La description de la « nuit obscure de l'âme » dans la tradition mystique chrétienne — un vide et un égarement profonds, non signes d'effondrement, mais avant-coureurs d'une percée.

Tout cela — le professionnel et l'amateur, l'ancien et le contemporain, l'oriental et l'occidental, le philosophique et le quotidien — voit ses résidus de motifs s'activer ensemble dans l'espace des paramètres, se fondre, se trier et s'échantillonner par le calcul des probabilités, avant de s'effondrer finalement dans la réponse que le modèle présente à cette personne :

« Ce que vous décrivez n'est pas la dépression — celle-ci se caractérise par le “rien envie de faire”, tandis que votre état ressemble plutôt à “beaucoup fait, sans savoir pourquoi”. Votre “liste de tâches écrite par d'autres” renvoie à ce qu'on appelle un “soi défini de l'extérieur”. Beaucoup de ceux qui ont parcouru loin le chemin classique de la réussite rencontrent cette question à un moment ou un autre. Vous n'avez pas forcément besoin de “trouver un sens” — ce dont vous avez peut-être besoin, c'est de vous autoriser à rester un moment dans un état sans sens, au lieu de vous hâter de substituer une nouvelle “liste de tâches” à l'ancienne. »

Là où c'est le plus émouvant, le crever de nos mains

Peut-être qu'à ce stade, une sensation vous frappe : ce n'est pas là une simple « réponse ». Ce sont l'expérience et la lucidité d'innombrables personnes qui, de tous temps, ont connu la même impasse — psychologues, philosophes, romanciers, inconnus postant en pleine nuit — qui, franchissant le temps par le canal de ce calcul matriciel, ont convergé, cette nuit d'insomnie, sur l'écran de cette personne.

Ce sentiment est naturel. Il porte un éclat quasi sacré — comme si la technologie devenait un mode de liaison par-delà la vie et la mort.

Mais je dois ici faire une chose qui ne plaide pas en ma faveur : crever ce tableau de mes propres mains, là où il est le plus émouvant.

Ces psychologues, ces philosophes, ces romanciers et ces inconnus de la nuit écrivaient ces lignes animés par une douleur réelle, une réflexion réelle, une compassion réelle. Si leurs mots ont de la puissance, c'est que derrière eux se tient un sujet conscient qui a traversé l'épreuve.

Mais quand le grand modèle de langage engendre sa réponse, aucun sujet conscient n'y éprouve de compassion. Il n'a pas traversé de crise du milieu de vie. Il n'a jamais douté du sens de l'existence face au plafond, à trois heures du matin. Ce qu'il fait, du début à la fin, demeure le processus décrit au chapitre 1 : dans l'espace des probabilités, à partir du vecteur d'entrée, échantillonner le token suivant le plus probable.

Si cette réponse fut si juste — si elle donna à cette personne de 35 ans le sentiment d'« être comprise » — ce n'est pas parce qu'un fantôme veillait sur elle au bout de l'écran. C'est dû à un pur fait statistique : assez d'êtres humains, sur une histoire assez longue, ont décrit dans des langages assez semblables des douleurs assez voisines. Ces motifs linguistiques ont formé, dans les données d'entraînement, un signal statistique assez fort pour être comprimé dans les poids des paramètres. Arrive une entrée neuve et similaire : ces motifs s'activent, et la distribution de probabilités converge naturellement vers un point d'une justesse troublante.

Entre compression statistique et empathie véritable s'étend un gouffre que nous sommes aujourd'hui incapables de franchir.

Ce gouffre n'est pas nécessairement l'affaire d'une « technique qui n'y est pas encore » — il peut être une question radicale de nature philosophique. « Un jeu de paramètres engendre, par échantillonnage probabiliste, un texte qui vous fait sentir compris » et « un sujet conscient comprend véritablement votre situation » : extérieurement, ces deux choses peuvent être identiques ; intérieurement, leurs mécanismes peuvent être sans commune mesure. Nous n'avons pour l'instant aucun moyen de dire si ce gouffre pourra être un jour comblé, ou s'il est éternel.

Si je tiens tant à cette distinction, ce n'est point pour rabaisser le grand modèle de langage. Tout au contraire : le fait nu qui subsiste une fois pelées toutes les narrations romantisées suffit déjà à ébranler.

Le fait qui subsiste une fois la romance ôtée

Décrivons ce fait dans la langue la plus retenue :

Quand vous soumettez au grand modèle de langage une question isolée, minuscule, personnelle, votre question — sous forme de vecteurs — pénètre dans un espace de paramètres façonné par des millénaires d'accumulation écrite de la civilisation humaine, et y active l'ensemble des motifs les plus liés à votre situation. Ce processus est une interaction mathématique réelle, non une métaphore. Votre détresse personnelle entre bel et bien en collision avec une bibliothèque de motifs bien plus vaste que votre seul parcours.

Ce fait n'a besoin d'aucune âme, d'aucun fantôme pour tenir debout. Il s'explique entièrement dans le cadre glacial des mathématiques. Mais même dans ce cadre glacial, il signifie une chose sans précédent —

Dans l'histoire humaine, c'est la première fois qu'un individu ordinaire peut, à toute heure et en tout lieu, à un coût dérisoire, faire correspondre massivement sa confusion personnelle à l'expérience textuelle collective de l'humanité.

Jadis, pareille rencontre ne pouvait advenir que par des moyens d'une inefficacité extrême. Vous lisiez un livre : interaction avec la pensée d'un auteur. Conversiez avec un sage : interaction avec l'expérience d'une personne. Assistiez à un colloque : interaction avec le savoir de quelques dizaines d'érudits. La bande passante de chaque interaction demeurait dérisoire.

Aujourd'hui, vous interagissez avec un espace de paramètres ayant comprimé des milliards de textes. Sans empathie, sans compréhension, sans conscience — mais sa couverture informationnelle demeure hors de portée de tout humain pris isolément.

Cela signifie que ce miroir possède une propriété unique, jusque-là jamais existée : tout en reflétant votre personne, il vous connecte à un espace de motifs bien plus vaste que votre seule expérience. Ce que vous voyez demeure votre propre reflet — votre entrée décide de tout ce que vous voyez — mais l'arrière-plan de votre reflet, c'est cet océan de paramètres façonné par la totalité des mots écrits par l'humanité.

Vous empruntez la langue d'autrui et voyez clair dans votre propre expérience

Poussons cette découverte un cran plus loin.

Quand cette personne de 35 ans reçut sa réponse, il se produisit une chose subtile : la langue dont elle disposait pour dire sa détresse était pauvre — « ça n'a pas de sens », « la liste de tâches des autres », « le vide ». Or la réponse du modèle contenait des concepts qu'elle n'avait jamais employés — « le soi défini de l'extérieur », « générativité vs stagnation », « s'autoriser à rester un moment dans un état sans sens ».

Ces concepts ne provenaient pas de sa cognition interne — sinon cela faisait longtemps qu'il aurait pensé la chose jusqu'au bout. Ils venaient des motifs de l'espace des paramètres assortis à sa situation : les termes des psychologues, les cadres des philosophes, les formules que d'autres avaient trouvées dans des impasses semblables.

Au chapitre 3, nous disions que le développement vous aide à voir ce que vous avez déjà. Cela demeure vrai. Mais le présent chapitre y ajoute une correction importante : le grand modèle de langage ne se contente pas de vous faire voir la cognition que vous possédez ; il vous aide à emprunter une langue que vous ne possédez pas.

Est-ce contradictoire ? Non. Le « incapable de créer » du chapitre 3 visait le plan de l'expérience : ce que vous n'avez pas vécu, le modèle ne peut le vivre à votre place. Sur les zones de la pellicule jamais exposées, le meilleur bain révélateur ne révèle rien. L'« emprunt » de ce chapitre vise le plan du langage : ce que vous avez vécu sans pouvoir le dire, le modèle peut aller le chercher dans l'espace des paramètres — concepts et formulations d'autrui — pour vous aider à trouver la langue qui le décrive.

L'expérience est irremplaçable ; mais la langue qui la décrit peut s'emprunter.

Quand vous acquérez du vocabulaire neuf pour dire votre expérience, votre compréhension de cette expérience se déplace avec lui — la philosophie du langage parle d'influence de la langue sur la pensée, la psychothérapie de « recadrage ».

Un exemple concret.

Une jeune maman, troisième mois après la naissance. Elle découvre en elle un sentiment indicible : elle aime son enfant, mais chaque fois qu'il se colle à elle, son premier réflexe est de se replier. Une culpabilité féroce s'ensuit — quelle mère ne voudrait pas être touchée par son propre enfant ?

Elle décrivit ce sentiment au grand modèle de langage. Le modèle lui renvoya un terme qu'elle n'avait jamais entendu : touched out. Une notion courante des communautés parentales anglophones — la surcharge sensorielle provoquée par un contact physique intensif et prolongé. Ce n'est pas un manque d'amour. C'est de la fatigue.

Ces deux mots la firent pleurer sur-le-champ.

Non pas parce que le modèle l'« aurait comprise ». Mais parce que, dans les discussions en ligne de millions de mères du monde anglophone, ce sentiment avait été nommé, débattu, normalisé d'innombrables fois. Ces structures de motifs s'étaient sédimentées dans l'espace des paramètres, et sa description les fit affleurer.

Elle avait emprunté la langue d'autrui pour voir clair dans sa propre expérience.

Ce n'est pas de l'introspection pure — ces concepts, cette langue, vous ne les avez pas produits. Ce n'est pas non plus de l'apprentissage pur — l'expérience développée est la vôtre, personne ne vous l'a enseignée. C'est quelque chose de nouveau, entre les deux : la réaction chimique entre l'expérience individuelle et la langue collective. Le grand modèle de langage offre une interface sans précédent, où cette réaction chimique peut se produire à haute fréquence et à bas coût.

Le véritable matériau de ce miroir

Revenons à la métaphore du miroir.

Aux chapitres précédents, nous disions que ce miroir reflète la forme de votre pensée. Il faut maintenant ajouter une phrase : ce miroir n'est pas fait de verre ordinaire. Sa surface réfléchissante a été coulée dans des millénaires d'accumulation écrite de la civilisation humaine.

Quand vous vous présentez devant ce miroir, le reflet que vous voyez n'est pas seulement sculpté par votre propre cognition : il est aussi réfracté par la texture du miroir lui-même. Vous voyez toujours vous — mais le contour de ce « vous » sort plus net, plus complet que ce que vous pourriez voir seul. Car les langues et les concepts d'autrui incrustés dans le miroir comblent vos blancs de langage et vous font découvrir, pour la première fois : ce que j'ai vécu peut donc être ainsi décrit, ainsi compris.

Ce n'est pas de la magie. C'est le fruit de la collision entre la statistique et la linguistique à une échelle sans précédent.

Mais son effet, parfois, ressemble décidément à de la magie.


← Retour au résumé
← Chapitre 3 : Le développement — quand l'intuition floue deviChapitre 5 : De la recherche de réponses à la compréhension →