Avez-vous déjà demandé un grand pardon ?
À quelques heures de Kippour, une conversation avec la talmudiste Sophie Goldblum
Auteur
Date
J’ai l’impression que tout le monde en parle : auteurs, éditeurs, lecteurs, non-lecteurs. En somme, la descendance d’Adam tout entière se passionne pour l’affaire Thélyson Orélien. Je vous résume, au cas où vous seriez passés à côté. Thélyson Orélien est l’auteur de C’était ça ou mourir (Grasset), un roman encensé par de nombreux critiques et l’un des favoris des prix littéraires d’automne. Mais voilà, ce livre aurait été écrit par une IA, et son auteur est par ailleurs accusé d’avoir plagié d’autres textes par le passé.
Cette histoire pose des questions vertigineuses. La première, bien sûr : est-ce véritablement le premier livre écrit par une machine à être loué par des humains ? Vient ensuite la question morale. Jamais encore un roman de cette envergure n’avait été soupçonné d’avoir été écrit avec un LLM. Maintenant que c’est le cas, on peut se demander : est-ce une faute ? Et, sans doute plus difficile, continuer : pourquoi ce livre a-t-il tant plu ? Est-ce en raison du snobisme du petit milieu, puisqu’il s’agit du dernier livre publié par Olivier Nora chez Grasset ? De la personnalité de l’auteur, migrant et racisé ? Ou tout simplement parce que l’IA, qui bat depuis longtemps les champions d’échecs et de go, sait désormais produire de la littérature qui plaît ?
Je vais vous le dire tout net : s’il a effectivement utilisé un LLM et plagié, ce qui semble probable, cet homme a toute ma compassion. J’ai toujours eu une grande compréhension pour les plagiaires. Quand j’étais étudiant, je souffrais devant tous ces grands textes. J’avais le sentiment que tout le monde écrivait mieux que moi, et que la vie serait bien plus simple si je pouvais m’emparer de leurs phrases. Il y a quelque chose de profondément humain chez ces fous qui « empruntent » un paragraphe à Cioran ou à Aragon : eux, au moins, aiment la littérature, ils l’aiment même plus que leurs lecteurs.
Puis les LLM sont arrivés, et, reconnaissons-le, beaucoup de choses se sont améliorées. « Que celui qui n’a jamais péché lui jette la première pierre », disait l’autre. Eh bien, puisqu’il faut se confesser, je plaide coupable. Je ne pourrais pas plus me passer d’eux que d’un traitement de texte. J’avais honte de mes fautes d’orthographe : Claude m’a rendu ma dignité.
Voilà pourquoi je ne souhaite évidemment pas accabler cet homme, qui, au fond, a fait œuvre utile en nous donnant à réfléchir. Il est à peu près certain que les éditeurs et les publications en tout genre vont devoir rédiger une charte pour définir ce qui est licite, comme les restaurants précisent que leurs plats sont faits maison.
Pour tenter de comprendre ce moment de bascule, je me suis entretenu avec Samuel Fitoussi, l’un de ceux qui ont sorti l’affaire.
Cela fait un an et demi que l’essayiste travaille dans l’investissement en IA. Son métier, précise-t-il, n’a aucune incidence sur ce qu’il pense, mais c’est lui qui l’a conduit vers un sujet qu’il ignorait presque. Il s’est d’abord plongé dans le fonctionnement des modèles de langage. Puis sa réflexion a glissé vers une question qui lui donne, dit-il, « le vertige » : quelle place pour l’homme dans un monde où les machines font tout mieux que lui ?
Car c’est bien là que nous allons, assure-t-il. Les laboratoires le disent eux-mêmes : l’AGI, cette intelligence artificielle générale censée surpasser l’humain dans toutes les tâches cognitives, est très proche. Déjà, des IA résolvent en quelques jours des problèmes mathématiques sur lesquels des chercheurs butaient depuis des décennies. Et les voici en lice pour les prix littéraires les plus prestigieux en France.
Le mot qui l’occupe, slop, vient des États-Unis, où il s’est imposé depuis un an ou un an et demi. On peut le traduire par « bouillie ». Les lecteurs les plus fidèles de ces pages connaissent déjà la notion de slopagande. Il désignait d’abord les textes générés par IA que certains copient-collent sur les réseaux sociaux, à une époque où ces textes étaient imprécis, truffés d’erreurs factuelles, peu rigoureux. Mais les modèles ont tant progressé, estime-t-il, que leur production n’a plus rien d’une bouillie. Elle peut même être brillante. Du livre de Thélyson Orélien, il a écrit le matin même sur X que si un humain en avait écrit chaque mot, on aurait pu saluer une forme de « génie littéraire ». Il trouve beaucoup à redire à ce style, mais reconnaît qu’on admirerait un humain capable d’en soutenir le rythme sur tant de pages.
Pourquoi, dès lors, parler encore de slop ? Parce que le mot désigne désormais autre chose, répond-il. Le lecteur ne peut plus savoir s’il lui faudra plus de temps pour lire un texte qu’il n’en a fallu pour le produire. Dans ce cas, selon lui, le contrat moral qui lie l’auteur à son lecteur est rompu. Je lui objecte qu’on peut passer des années sur un texte minable, et que Picasso disait avoir mis des années à apprendre un geste qu’il exécutait en un instant. Il en convient : la valeur d’une œuvre ne se mesure pas à l’effort investi. Mais, dit-il, il faut bien choisir ce qu’on lit, et il y a trop de textes pour tout lire. Le temps passé sur son œuvre était un signal, certes imparfait, qui indiquait que l’auteur jugeait son propos important.
Surtout, un texte n’est pas une chaise. Qu’un meuble sorte des mains d’un artisan ou d’une usine robotisée nous est indifférent. Mais lire, c’est rencontrer une autre subjectivité. Nous sommes des animaux sociaux, qui avons évolué en petits groupes. Si nous pouvons rester des heures seuls dans une chambre avec un livre, c’est parce que nous y communiquons avec quelqu’un, fût-il mort.
Le texte généré ne serait-il pas, comme la junk food, plus flatteur qu’un Saint-John Perse ou un Mallarmé ? À bien des égards, oui, admet-il. Ceux qui éreintent le style de Thélyson Orélien sont souvent des familiers des modèles de langage, lassés d’en reconnaître les tournures, et il en fait partie. Mais l’IA sait déjà bien écrire. La raison en est l’apprentissage par renforcement : à force de voir des humains désigner les textes qu’ils préfèrent, elle apprend ce qui nous touche.
Faut-il y voir un « goût moyen », comme en cuisine ? Samuel Fitoussi ne le croit plus. L’argument selon lequel l’IA, faisant la moyenne des préférences humaines, ne produirait jamais rien d’exceptionnel est à ses yeux de moins en moins vrai. L’IA s’entraîne aussi sur ses propres productions : sur mille textes, elle en réussit un ou deux excellents, et on la réentraîne sur ceux-là. Rien ne plafonne alors sa qualité littéraire. Il cite AlphaGo, l’IA de DeepMind qui, vers 2016 ou 2017, plafonnait au niveau des meilleurs joueurs de go dont elle avait étudié les parties. Elle ne les a dépassés qu’en jouant contre elle-même et en apprenant de ses victoires. Le texte suit cette trajectoire, prédit-il. D’ici deux ou trois ans, une IA pourra écrire, à partir de consignes sommaires, des romans qui rafleraient tous les prix littéraires du monde si leur origine restait cachée.
D’où l’importance de Pangram, le logiciel de détection qui a servi à confondre le roman. Sa fiabilité, rappelle-t-il, n’est pas seulement proclamée : des enquêteurs et auditeurs indépendants l’ont vérifiée, notamment pour son très faible taux de faux positifs. Le logiciel est entraîné sur des millions de textes humains et artificiels, et il apprend à repérer la trace statistique de l’IA. Écrire deux pages, explique-t-il, c’est effectuer sans le savoir des millions de micro-choix. Sur une phrase, qu’un humain fasse les mêmes choix qu’une IA peut relever du hasard. Sur des centaines de phrases, cela devient extrêmement improbable.
Enfin, dénoncer un plagiat, est-ce de droite ? Fitoussi ne cache pas être plutôt de droite et libéral. Mais il ne comprend pas que l’on range ce débat dans des « clivages tribaux ». L’affaire est partie d’un lecteur qui, connaissant sa crainte de voir l’IA supprimer l’écriture et la lecture, lui a signalé ce livre en le soupçonnant d’avoir été généré. Avec les amis de son collectif, il a alors mené tests et vérifications, sans aucune visée idéologique. Leur combat, dit-il, vise le slop, qui abîme la lecture et brouille la frontière entre l’homme et la machine. Ils jugent immoral de trahir la clause implicite d’authenticité qui lie un auteur à ses lecteurs, et se sont sentis le devoir d’alerter sur une « probable supercherie ».
Les opinions politiques de l’auteur, ils les ignoraient. Sa couleur de peau, dit-il, ne leur a jamais traversé l’esprit, et Samuel Fitoussi juge « ahurissant » que certains racialisent le débat. Il rappelle que les premiers comptes épinglés par Balance ton Claude étaient plutôt des comptes de droite versés dans la technologie, très fiers de leurs longs pavés rédigés par IA. Lui-même se dit en guerre contre ce qu’il appelle la « droite techno » : une droite qui pense la technologie sans rigueur, plaque des schémas généraux sur le particulier et, convaincue que l’IA ne peut avoir d’effets pervers, s’interdit d’y réfléchir.
Restait la question morale posée par le plagiat. Je me demandais ce qu’en pensait le Talmud, où il s’agit sans cesse de citer d’autres rabbins. J’ai donc interrogé la rabbine Myriam Ackermann-Sommer.
Le Talmud, m’explique-t-elle, c’est la Torah orale, et il faut vraiment comprendre ce que cela signifie : une culture de l’oralité. De cette oralité découle un principe central, amirat davar be-chem omro. Quand on dit quelque chose, on doit rapporter le nom de celui qui nous l’a appris. On le retrouve un peu partout, par exemple dans les Maximes des Pères. Quand on y demande comment devenir un bon étudiant de la Torah, l’une des réponses est qu’il faut être omer davar be-chem omro, dire la chose au nom de celui qui l’a dite. On nous dit même que cela apporte la délivrance, que l’ère messianique adviendra grâce à ceux qui rapportent les propos sans plagier. Dans ce cadre, le plagiat consiste précisément à rapporter un enseignement sans dire qui nous l’a appris.
Le traité Yevamot, consacré au lévirat, rapporte à ce sujet un bel épisode de grabuge entre les Sages. Au IIIe siècle, à Tibériade, Rabbi Éléazar, raconte Myriam Ackermann-Sommer, énonce une halakha, un élément de loi, sans citer son propre maître, Rabbi Yohanan. Celui-ci est furieux : qu’est-ce que c’est que cet élève qui ne cite même pas ses maîtres ? Ne pas nommer celui qui nous a enseigné est perçu comme la honte ultime.
C’est pourquoi la littérature talmudique contient une formule en soi très lourde : amar untel, amar untel, « untel a dit qu’untel a dit qu’untel a dit ». On y trouve parfois quatre noms de suite. Il s’agit de retracer la chaîne de la transmission, qui est l’élément le plus essentiel pour comprendre toute la Torah orale. Les Maximes des Pères s’ouvrent d’ailleurs sur cette chaîne, la massoret : Moïse a reçu la Torah au Sinaï et l’a transmise à Josué. Suivent, dans l’ordre chronologique, tous les maillons de la transmission jusqu’à nous. Citer ses maîtres est une question d’autorité plus qu’une règle déontologique de bibliographie universitaire. Nommer celui qui nous a enseigné permet d’ancrer nos propos dans une tradition plus ancienne, et donc de justifier leur validité.
Le plagiat est ainsi assimilé à un vol. Un midrash commentant le verset des Proverbes « Ne vole pas le pauvre », compare celui qui s’attribue l’enseignement d’autrui à quelqu’un qui volerait un pauvre. Pourquoi un pauvre ? Il n’est pas si pauvre, le pauvre, miskine : il a plein d’enseignements derrière lui. Mais une autre idée, très présente dans le Talmud, éclaire ce passage. Les justes, même morts, sont appelés vivants, parce qu’on continue de les citer. Être cité, c’est la garantie de survivre à travers ses enseignements. Ne pas citer quelqu’un, c’est le priver de cette survie.
Ces chaînes de citations produisent d’ailleurs une étonnante impression de synchronie. Le Talmud fait dialoguer des Sages que séparent plusieurs générations, parfois plusieurs siècles, au point qu’on ne s’en rend même plus compte. C’est par cette tradition orale qu’on maintenait les défunts en vie : en citant les morts, on les rend vivants. On comprend alors que voler un enseignement soit plus grave encore que voler un objet. Un objet peut être restitué. Un enseignement volé s’est déjà imprimé dans l’esprit des gens comme étant le nôtre, et le mal est bien plus difficile à réparer.
Cette question rejoint celle des LLM. Le Talmud de Jérusalem, dans le traité Péa, dit en substance que le savoir est un système fini. Quand on croit avoir inventé quelque chose, on ne fait jamais que répéter l’enseignement de quelqu’un d’autre. On pourrait comparer cela à une base de données : les LLM ne font que piocher dans un ensemble fini qui contient toutes les propositions qu’on leur a soumises. L’étudiant qui, dans la maison d’étude, s’écrie qu’il vient de révolutionner la Torah découvre que cela avait déjà été dit.
C’est un peu tristounet, et même antiscientifique, puisque cela revient à dire qu’on ne découvre jamais rien. Tout ce qu’on trouvera dans la Torah y a déjà été énoncé, ce qui minimise le pouvoir de la découverte. Mais c’est aussi rassurant, selon Myriam Ackermann-Sommer : la créativité s’insère dans un système qui la légitime. Reste la question de fond. Découvre-t-on vraiment ce que l’on découvre, ou se nourrit-on toujours d’une infinité de sources ?
La rabbine s’est d’ailleurs demandée si, en formulant une phrase, elle ne fonctionnait pas elle-même comme une IA, par une sorte de cumul statistique de ce qui a le plus de chances d’être dit ensuite. Elle s’en rend compte en anglais, langue qu’elle maîtrise très bien sans que ce soit sa langue maternelle. Elle y fonctionne de manière prédictive : quand elle commence une phrase, elle cherche ce qu’il serait le plus idiomatique de dire ensuite. En français, elle ne le perçoit pas, sans doute parce qu’elle en a appris les collocations en même temps que la langue. Pourtant, la fin d’une phrase s’y déroule, là aussi, de façon presque prédictive, en fonction de l’idée à transmettre. On se glisse toujours dans des cadres préexistants du langage. Elle n’est donc pas sûre que nous soyons si différents des LLM. Quand on dit qu’ils ne font que prédire, elle a envie de répondre : nous aussi. Ce n’est peut-être pas là que ça se joue.
Et au fait, les LLM peuvent-ils faire concurrence aux rabbins ? Certains disent déjà « l’IA, c’est mon psy » : ils lui confient qu’ils ne vont pas bien, décrivent leurs symptômes, et elle se montre très compréhensive, avec des petits cœurs et des vœux de rétablissement. Personne, en revanche, ne dit encore à Myriam Ackermann-Sommer « l’IA, c’est mon rabbin ». Ce qui lui paraît évident, c’est qu’on peut l’employer comme une base de données, une encyclopédie interactive, pour rechercher des sources et des responsa, et trouver les positions des décisionnaires. Pour la collecte d’information, pourquoi pas. Pour l’instant, l’IA a encore tendance à halluciner des sources et à inventer des références. Mais cela va vite se perfectionner, d’ici six mois, un an, un an et demi peut-être. Là n’est donc pas la question.
La question, c’est qu’une IA n’est pas un rabbin. Quand on va voir un rav, c’est qu’on a un problème et qu’on cherche une solution, en général dans le cadre de la loi. Prenons quelqu’un qui doit jeûner à Kippour mais qui a souffert d’anorexie. L’IA ne se substituera pas à une fonction qui tient presque du psy ou de l’assistante sociale. Un bon rav, une bonne rabba, doit connaître les sources, et l’IA pourrait en partie s’en charger, avec vérification. Mais il doit aussi connaître tous les détails qui entourent la question, c’est-à-dire comprendre vraiment la personne et sa psyché. Ce qu’on cherche auprès d’un rabbin, c’est ce contact et cette évaluation humaine, et un LLM ne pourra pas l’offrir.
C’est la raison pour laquelle les rabbins observent encore l’IA avec une relative sérénité : pour la plupart, ils ne sont pas des auteurs.
À quelques heures de Kippour, une conversation avec la talmudiste Sophie Goldblum
Faux prophètes, génisses rousses, rabbins prudents et révolutionnaires impatients : avec le philosophe Pierre Bouretz un itinéraire dans la plus ancienne et la plus explosive des attentes juives