Détecteurs d'IA : un score n'est pas un verdict, l'affaire Orélien le prouve
Le monde littéraire québécois est secoué par l'affaire Thélyson Orélien, cet auteur accusé d'avoir utilisé l'intelligence artificielle pour écrire ses textes. Mais avant de crier au loup, prenons une grande respiration. L'histoire récente nous montre que les détecteurs d'IA, aussi sophistiqués soient-ils, peuvent se tromper lourdement.
L'affaire Nazir : un précédent qui donne à réfléchir
Plus tôt cette année, l'écrivain Jamir Nazir a remporté le prestigieux Commonwealth Short Story Prize pour la région des Caraïbes, puis le prix global. Des observateurs ont soumis sa nouvelle au détecteur Pangram, qui a attribué un score de 100 % de contenu généré par IA. La controverse a ébranlé la Commonwealth Foundation, qui a mené une enquête approfondie sur le processus créatif de l'auteur, en examinant ses brouillons, ses versions et ses notes.
Conclusion : la Fondation s'est dite convaincue que l'IA n'avait pas été utilisée et a maintenu le prix. Un cas d'école qui devrait nous inciter à la prudence.
Mon propre test avec Pangram : un faux positif flagrant
Pour évaluer la rigueur de l'outil, j'ai soumis un essai que je publie la semaine prochaine sur l'objectivité journalistique. Résultat : 12 % IA. Intrigué, j'ai analysé les phrases signalées par le détecteur. Quatre d'entre elles commencent toutes de la même manière : « Comment couvrir... », « Comment traiter... », « Comment jouer... », « Comment appliquer... ».
Ce qui a déclenché l'alarme, c'est l'accumulation de phrases interrogatives parallèles, de longueur comparable, avec une syntaxe régulière. Autrement dit, un simple motif stylistique, une répétition. Un faux positif typique.
Les détecteurs d'IA : des outils utiles, mais pas infaillibles
Comme l'a écrit la Commonwealth Foundation : « Ces outils peuvent servir d'indicateurs utiles d'une implication potentielle de l'IA, mais ils ne peuvent, à eux seuls, fournir une preuve concluante. »
Dans le cas d'Orélien, qui a publié 10 textes chez nous depuis 2025, sa parole contre celle de la machine. Les scores frôlent les 100 %, ce qui soulève des questions légitimes. Mais un score de détection n'est pas un verdict, c'est une raison de creuser, de vérifier.
La bonne posture : enquêter avant d'accuser
Les maisons d'édition devraient examiner les différentes versions des manuscrits avant de se prononcer. L'affaire Nazir démontre qu'on ne peut s'arrêter à un score positif. Un motif stylistique n'est pas une preuve de provenance artificielle.
La question n'est pas de savoir quel score donne Pangram, mais bien si l'explication de l'auteur et les traces de son parcours artistique le disculpent. Nous poursuivons notre travail d'enquête, avec rigueur et ouverture d'esprit.