Avec l'avènement de l'IA, et notamment des outils de vérification basés sur l'IA, le métier d'écrivain est en pleine mutation. Que signifie la vérification de l'utilisation de l'intelligence artificielle pour les écrivains, mais aussi pour les journalistes ? Guido van Nispen nous a envoyé un article à ce sujet, Wijbrand Schaap s'en est saisi au nom de la rédaction et lui a posé quelques questions. Nous avons jugé utile de partager avec nos lecteurs la conversation par e-mail qui en a découlé.
La contribution de Guido van Nispen :
Un roman est encensé, un article d’opinion convainc et une œuvre d’art nous touche, jusqu’à ce que quelqu’un y passe un détecteur d’IA et y ajoute un pourcentage. L’œuvre elle-même n’a alors pas changé, mais notre regard sur celle-ci, d’autant plus. Il en résulte une nouvelle charge de la preuve singulière dans le secteur culturel : alors que nous nous sommes inquiétés pendant des années de machines capables de se faire passer de manière convaincante pour des humains, nous entrons désormais dans un monde où les humains devront peut-être prouver qu’ils sont bel et bien des humains.
Un roman qui a soudain pris une autre tournure
Le premier roman de l’écrivain haïtien-canadien Thélyson Orélien, *C’était ça ou mourir*, semblait au départ surtout un succès littéraire remarquable. En cinq semaines, 35 000 exemplaires ont été vendus en France, le livre a remporté le prix du roman de la Fnac et a été sélectionné pour plusieurs prix littéraires français prestigieux. Les critiques l’avaient lu, les libraires l’avaient recommandé, les jurys l’avaient évalué et les lecteurs l’avaient acheté, ce qui signifie que l’ouvrage avait suivi exactement ce que l’on considère généralement, dans le monde culturel, comme un processus assez rigoureux d’appréciation et de sélection.
Tout a changé lorsqu’un compte anonyme sur X a affirmé que le livre avait été écrit presque entièrement par une intelligence artificielle. Pour étayer cette affirmation, il a été fait référence à Pangram, un détecteur d’IA qui tente de déterminer si un texte a été produit par un humain ou par un modèle linguistique. Le Monde a décidé d’enquêter sur cette affirmation et a saisi plus de la moitié du roman dans Pangram, après quoi le détecteur a classé plus de 95 % du texte examiné comme étant rédigé par une IA.
Ce n’est pas sans importance, car Pangram fait partie des détecteurs d’IA les plus performants et a également obtenu des résultats relativement bons dans deux études universitaires citées par Le Monde. Dans le même temps, le système reste en grande partie une « boîte noire » pour les non-initiés : l’entreprise s’est montrée peu disposée à s’exprimer auprès du journal sur son fonctionnement précis, et les chercheurs avertissent que les performances peuvent varier selon les langues et les styles d’écriture particuliers. Il subsiste donc juste assez d’incertitude pour créer une situation délicate : le pourcentage est trop élevé pour être simplement ignoré, mais la méthode n’est pas suffisamment transparente pour être considérée sans réserve comme une preuve.
Ce qui est intéressant ensuite, c’est l’effet d’un tel pourcentage sur notre perception. En effet, rien n’a changé dans le roman, et il en va de même pour les mots sur lesquels les lecteurs, les libraires et les membres du jury avaient fondé leur jugement initial. Seule une nouvelle information a été ajoutée, provenant d’une machine qui prétend en savoir quelque chose sur la manière dont ces mots ont vu le jour. À partir de ce moment-là, nous ne nous contentons plus de lire le roman, mais nous y lisons également le soupçon.
Il restait encore quelque chose à vérifier
Cette distinction est importante, car tous les débats sur l'utilisation de l'IA ne se valent pas. L'année dernière, nous avons été confrontés à un cas tout à fait différent concernant Peter Vandermeersch, ancien rédacteur en chef du NRC, qui avait utilisé l'IA pour traiter et résumer des sources destinées à ses publications. Une enquête plus approfondie a révélé que plusieurs articles contenaient des citations qui ne pouvaient pas être rattachées aux sources d'origine. M. Vandermeersch a alors reconnu avoir utilisé l'IA et admis que le contrôle humain nécessaire avait été insuffisant.
Il s'agissait donc d'un problème journalistique qui existait bien avant ChatGPT et pour lequel nous disposons déjà de normes journalistiques. Lorsqu'une personne est citée entre guillemets, elle doit avoir réellement prononcé ou écrit ces mots. Si ce n’est pas le cas, la publication est erronée et, au final, peu importe que l’erreur soit due à un modèle linguistique, à une note prise à la va-vite ou à un journaliste n’ayant pas suffisamment vérifié ses sources. C’est le contenu lui-même qui a mis en évidence le problème.
Dans le cas d’Orélien, il se passe quelque chose de fondamentalement différent. Personne n’a d’abord eu besoin de trouver dans son roman un personnage inventé, un passage plagié ou une inexactitude factuelle avérée. Le soupçon est né parce qu’une machine a examiné une œuvre culturelle reconnue et a conclu qu’elle avait probablement été créée par une autre machine. Le débat passe ainsi de la recherche de ce qui est manifestement erroné dans une œuvre à la question de savoir si nous faisons encore confiance à l’histoire de sa création.
Un pourcentage à côté d'un article d'opinion
Les Pays-Bas ont désormais eu un avant-goût de cette évolution. Cet été, AI Report a analysé 252 tribunes libres publiées dans le Volkskrant, le NRC, Trouw, Het Parool et le FD à l’aide de Pangram. Selon ce détecteur, 49 articles, soit près d’un cinquième du total, avaient été générés par l’IA. Les différences entre les journaux étaient frappantes : dans le Volkskrant, une part considérable des contributions analysées a été identifiée comme générée par l'IA, tandis que dans le NRC, aucun des articles d'opinion examinés n'a reçu cette classification. Si l’on tenait également compte des textes dans lesquels, selon Pangram, l’IA avait été partiellement utilisée, cette proportion augmentait encore davantage.
Pour les rédactions, de telles conclusions sont bien sûr pertinentes. Un journal est en droit d'imposer des conditions aux contributions envoyées, et les lecteurs sont en droit d'attendre d'une rédaction qu'elle sache ce qu'elle publie, surtout lorsqu'une contribution est présentée comme l'opinion personnelle d'un auteur. Dans cette optique, il est compréhensible que le Volkskrant ait renforcé ses contrôles à la suite de cette étude. La situation devient plus intéressante lorsque le détecteur lui-même fait partie intégrante de ce contrôle, car une probabilité statistique vient alors jouer un rôle dans un jugement rédactionnel qui, auparavant, reposait principalement sur le contenu, l’originalité, la fiabilité et la qualité.
On se retrouve alors face à la même situation étrange que dans le cas du roman français. Un lecteur peut trouver un article d'opinion intéressant et convaincant, un rédacteur en chef peut le sélectionner parce qu'il apporte un éclairage au débat public, et le texte peut être publié sans problème. Mais lorsque Pangram lui attribue ensuite un score d’IA élevé, le jugement porté sur ces mêmes mots change. Le détecteur n’a rien modifié dans le texte, mais il y a superposé une nouvelle couche de sens : peut-être que ce n’est pas ce que vous pensiez que c’était.
Quand l'outil devient un arbitre
Pour le secteur culturel, cela touche à une question bien plus fondamentale que le débat, désormais quelque peu prévisible, visant à déterminer si les écrivains, les artistes et autres créateurs ont le droit ou non d’utiliser l’IA générative. Les créateurs ont toujours eu recours à des outils, et les frontières entre la création, l’édition et l’assistance n’ont jamais été totalement nettes. Un écrivain travaille avec un éditeur, un photographe avec un logiciel de retouche d’images, un compositeur avec des instruments numériques et un cinéaste avec une technologie capable de créer des images qui n’ont jamais existé devant la caméra. L’IA générative rend cette boîte à outils plus complexe, car ces outils peuvent désormais écrire, dessiner, composer et faire des suggestions qui se retrouvent directement dans le produit final. C’est précisément pour cette raison qu’il est nécessaire de définir des règles en matière de transparence, de paternité et de responsabilité.
Un détecteur d'IA soulève toutefois un autre problème, car il ne se contente pas de faciliter la collecte d'informations, mais suggère également un jugement sur l'authenticité. Dès lors qu’un tel jugement commence à faire office de preuve au sein de la société, la charge de la preuve se déplace imperceptiblement. Celui qui affirme qu’une œuvre a été créée par une IA n’a alors plus besoin de reconstituer de manière convaincante comment cela s’est produit, tandis que l’auteur doit, lui, démontrer qu’il l’a créée lui-même.
Selon son éditeur, Orélien a commencé à écrire son roman dès 2017 et, aujourd’hui, des ébauches, des notes, des versions antérieures et de la correspondance sont utilisées pour rendre crédible l’histoire de la genèse de l’ouvrage. Ces éléments, qui faisaient autrefois simplement partie du processus chaotique et souvent invisible par lequel un écrivain crée un livre, acquièrent ainsi une nouvelle fonction : celle de preuves de la paternité humaine de l’œuvre. Pour les écrivains, les journalistes, les artistes et autres créateurs, cela peut finalement signifier qu'il faut non seulement conserver l'œuvre, mais aussi l'archéologie numérique de sa création.
Nous bouclons ainsi une boucle remarquable. Pendant des années, nous avons craint que l’IA ne devienne si performante que les machines puissent produire un travail que nous ne pourrions plus distinguer d’un travail humain, ce qui nous a amenés à construire des machines chargées de faire cette distinction à notre place. À présent que ces détecteurs s’améliorent sans cesse et que leurs taux de réussite semblent de plus en plus convaincants, un risque presque inverse apparaît : qu’un être humain crée quelque chose que les lecteurs apprécient, qu’une rédaction publie ou qu’un jury récompense, après quoi une machine nous indique que nous ferions mieux de revoir notre propre perception.
Peut-être que la question intéressante pour le secteur culturel ne réside donc pas seulement dans la mesure où un créateur est autorisé à utiliser l'IA, mais aussi dans l'autorité que nous sommes prêts à accorder à une machine qui, a posteriori, révèle qui était réellement le créateur. Car lorsqu’un roman bien accueilli peut, à cause d’un seul pour cent, se transformer en une œuvre suspecte, le débat ne porte déjà plus uniquement sur l’intelligence artificielle. Il porte alors également sur la question de savoir ce que nous considérons encore comme une preuve suffisante d’humanité.
La question de Wijbrand Schaap :
Salut Guido,
Je vais y réfléchir encore un peu. Le fait est que, bien avant que tu n'en arrives à cette confession très honnête et louable à la fin, j'avais déjà 90 % de certitude que le texte contenait beaucoup de formulations typiques de l'IA. Et ce, notamment parce que le style est assez impersonnel. Je suis habitué à ton style, et tu m’as déjà expliqué comment tu utilises l’IA, donc cela ne me pose pas vraiment de problème.
Je me demande toutefois : dans ce cas particulier, ne serait-il pas plus intéressant d'approfondir la manière dont vous avez utilisé l'IA ? Quelles instructions tu lui donnes ? Je trouverais ça sympa, par exemple, dans le cas présent de cet auteur critiqué à tort ou à raison (il y a aussi un côté raciste, tout comme chez ce professeur de musique de Cambridge). Que tu fournisses donc à un moment donné les consignes, en tant qu'auteur, afin que le lecteur puisse, s'il le souhaite, créer sa propre version. 🙂
Mais là, c'est sérieux. Ça te dirait ?
Je vous prie d'agréer, Madame, Monsieur, l'expression de mes salutations distinguées,
Wijbrand Schaap
Rédacteur en chef de Cultuurpers
La réaction de Guido van Nispen :
Salut Wijbrand,
Oui, ça me tente bien, justement parce que ta réaction apporte une dimension supplémentaire intéressante à cet article. Seulement, dans mon cas, il n’y a pas une seule consigne que je puisse te donner pour que cet article en ressorte. Quand je repense à ce processus, c’est plutôt une combinaison de recherche, d’exploration, d’écriture, de correction et de révision, dans laquelle l’IA joue un rôle différent à différents moments.
Tout commence par le fait que ChatGPT connaît désormais ce que j'appelle mon ‘ format Guido ’ pour la relecture finale. Ce format s'est développé au fil de nombreux textes et surtout de nombreuses corrections. Ce format comprend des éléments tels que : éliminer les fautes d'orthographe, de langue et de grammaire ; pas de phrases rhétoriques isolées ; un raisonnement fluide, calme et précis ; peu d'ornements ; pas de ton commercial ; et ne pas chercher à tout conclure pour le lecteur. Ces éléments font désormais partie du contexte du modèle et je n’ai donc plus besoin de les fournir à chaque fois sous la forme d’une longue consigne.
J’ai ensuite utilisé comme point de départ pour cet article mon texte précédent sur Orélien, rédigé pour LinkedIn, et j’ai mis en évidence la tension que j’y percevais : le public apprécie l’œuvre, puis un détecteur jette le doute sur celle-ci sans que l’œuvre elle-même n’ait subi la moindre modification. J'ai ensuite utilisé l'IA pour l'article de Le Monde pour traiter les informations et vérifier les faits, mais aussi pour rechercher de manière ciblée des exemples néerlandais. C'est ainsi que la question antérieure concernant Peter Vandermeersch a refait surface, que je souhaitais justement utiliser à titre de contraste, car on y avait trouvé des erreurs avérées et des citations inventées de toutes pièces. J’ai ensuite souhaité m’appuyer sur la récente étude menée avec Pangram concernant les articles d’opinion publiés notamment dans de Volkskrantet le NRC. J'ai donc moi-même décidé quels cas devaient y figurer, pourquoi ils devaient y figurer et comment ils s'articulaient les uns par rapport aux autres.
Puis vint le processus d'écriture et de révision, qui ne s'est certainement pas déroulé sans heurts dès le premier essai. J'ai réécrit la première version car elle contenait trop de phrases isolées et rhétoriques, ce qui ne correspondait pas à mon style d'écriture. La version suivante était plus aboutie ; j'ai ensuite travaillé séparément sur la conclusion et l'introduction, et j'ai encore affiné la tension narrative.
Suite à ton e-mail, j’ai d’ailleurs simplement demandé à ChatGPT s’il trouvait lui-même que mon style avait un côté très ‘ IA ’. J’ai trouvé sa réponse assez intéressante, car elle met précisément en évidence le problème que j’aborde également dans l’article. Selon le modèle, mon style habituel se caractérise par de longs raisonnements continus, peu d’embellissements rhétoriques et une distance analytique sereine. Ce sont là des caractéristiques que les LLM modernes sont désormais également capables de reproduire avec brio. Dans ce texte, selon ChatGPT, un élément supplémentaire venait s’y ajouter : la structure était exceptionnellement ordonnée, les transitions étaient très soignées et des formulations telles que ‘ Cela donne lieu à… ’, ‘ Cette distinction est importante… ’ et « Pour le secteur culturel, cela touche… » structuraient l’argumentation de manière presque un peu trop visible. Je suis un penseur structuré et je construis mes articles de la même manière ; apparemment, le modèle me connaît désormais très bien.
Je trouve en fait cette observation intéressante, notamment parce que ton jugement humain est bien plus nuancé que celui de Pangram. Tu dis en substance : ‘ Je reconnais ici des formulations et une fluidité qui me font fortement penser à l’IA. ’ Pangram affirme : « 100 % IA ». Ce sont là deux affirmations assez différentes. Et oui, comme tu peux le lire, je suis critique à l’égard de ces détecteurs d’IA et de leur utilisation. Je n’ai d’ailleurs aucune envie de passer mon style habituel par un « humaniseur » pour semer la confusion chez les détecteurs. J’écris ces textes pour le lecteur, et non pour les détecteurs.
À mes yeux, l'ensemble du processus s'apparente donc bien davantage à une collaboration avec un chercheur et un rédacteur (en chef) particulièrement rapides qu'à la simple attribution d'une mission à une machine qui se charge ensuite de rédiger mon article. En même temps, il serait naïf de nier que ce chercheur et ce rédacteur produisent effectivement des formulations qui se retrouvent dans le texte final. C'est précisément là que la question de la paternité de l'œuvre devient intéressante.
C'est pourquoi je ne peux pas me contenter de fournir une seule consigne fictive à publier, mais je dois au contraire montrer le processus, éventuellement dans un encadré séparé accompagnant l'article : depuis mon idée initiale et mes instructions, en passant par les recherches, les requêtes et mes cycles de correction, jusqu’au texte final puis à l’avis de Pangram. Le lecteur pourra alors déterminer lui-même à quelle étape de ce processus, selon lui, réside la paternité de l’œuvre.
Cordialement,
Guido
La proposition de Wijbrand Schaap
Ça te dirait de publier ton premier article, suivi de mon commentaire puis de ta réponse, sous forme de billet complet sur le site ?
Je vous prie d'agréer, Madame, Monsieur, l'expression de mes salutations distinguées,
Wijbrand Schaap
Rédacteur en chef de Cultuurpers
La réponse de Guido van Nispen :
Excellente idée !



