IA générative au tribunal : la directive née d'une jurisprudence inexistante
Une décision citant des précédents qui n'existaient pas a poussé une magistrature à encadrer l'IA générative. Ce que cette directive change pour la veille réglementaire.
À retenir
- Le Canada Français rapporte que les tribunaux du Québec ont publié des directives sur l'usage de l'intelligence artificielle générative, en affirmant que juger reste une fonction humaine.
- Le déclencheur est un incident documentaire précis : une décision contenant des références à une jurisprudence inexistante, produite par un outil génératif et non vérifiée avant publication.
- Pour les équipes de veille réglementaire, l'enjeu n'est pas l'interdiction de l'outil mais la traçabilité de chaque citation jusqu'à sa source primaire.
- Les directives professionnelles de ce type circulent en dehors des journaux officiels, ce qui les rend difficiles à capter par une veille limitée aux textes normatifs classiques.
L'intelligence artificielle générative est entrée dans les métiers du droit par la porte de service, celle des tâches invisibles : la synthèse d'un dossier volumineux, la reformulation d'un paragraphe, la recherche d'un précédent que l'on croit se rappeler. Cette entrée discrète explique pourquoi les institutions judiciaires ont tardé à formaliser une position. Tant que l'outil reste un accélérateur privé, il ne pose pas de question publique. Le jour où sa production se retrouve dans un acte qui fait foi, la question devient institutionnelle.
C'est exactement ce qui vient de se produire. Le Canada Français rapporte que les juges en chef ont émis des directives strictes à l'intention des juges face à l'intelligence artificielle générative, et que les tribunaux du Québec ont publié un encadrement de son usage affirmant que juger reste une fonction humaine. L'initiative n'est pas née d'un débat théorique sur l'automatisation : elle fait suite à un incident où une décision contenait des références à une jurisprudence inexistante.
L'événement mérite d'être lu au-delà du monde judiciaire. Il décrit un mécanisme de défaillance documentaire qui se rejoue à l'identique dans une note de veille ou un mémo de conformité : un texte plausible, bien construit, dont une partie des références ne renvoie à rien. Cet article détaille la directive, l'anatomie de l'incident qui l'a provoquée, et ce que les équipes de veille réglementaire ont à en retenir.
Ce que disent les directives publiées par les tribunaux du Québec
Le premier point de la directive, tel que le rapporte Le Canada Français, n'est pas une règle d'usage mais une affirmation de principe : juger reste une fonction humaine. Cette formulation n'est pas décorative. Elle ferme par avance la discussion sur l'assistance à la décision, en distinguant ce qui relève de l'outillage documentaire, potentiellement délégable, et ce qui relève de l'acte de juger, non délégable. Poser ce principe en tête d'un encadrement revient à dire que les modalités discutées ensuite ne déplacent pas cette ligne de partage.
Le second point est la qualification du caractère strict de l'encadrement. Une directive stricte, dans un environnement professionnel où l'autonomie de chaque magistrat est une garantie institutionnelle, signale que l'institution a estimé le risque supérieur au coût de la contrainte. Ce type d'arbitrage se lit dans le vocabulaire employé, et c'est ce que doit relever une veille attentive : la différence entre une recommandation, un cadre de bonnes pratiques et une directive stricte n'est pas de style, elle est de régime.
Le troisième point tient à l'auteur du texte. Ce ne sont ni le législateur ni un régulateur sectoriel qui produisent la norme, mais les juges en chef eux-mêmes, c'est-à-dire l'autorité interne de la profession. Cette production normative échappe aux canaux habituels de la veille juridique : elle ne passe ni par un journal officiel ni par une base de textes consolidés, ce qui la rend plus difficile à capter que la modification d'un article de code.
Une jurisprudence inexistante : l'anatomie d'un incident documentaire
L'incident déclencheur se résume en une phrase : une décision contenait des références à une jurisprudence inexistante. Ce qui rend cet événement instructif, c'est qu'aucune étape du processus n'a échoué de façon visible. Le texte produit était syntaxiquement correct, la mise en forme des citations respectait les conventions du domaine, les noms de parties et les numéros de dossier avaient l'apparence attendue. La défaillance ne s'est pas manifestée par une erreur repérable, mais par l'absence de référent derrière une forme parfaitement conforme.
C'est la signature caractéristique des systèmes génératifs. Ils sont optimisés pour produire ce qui ressemble à la réponse attendue, et une citation juridique est un objet dont la forme est extrêmement régulière, donc facile à imiter. Le modèle ne distingue pas la production d'une référence réelle de la production d'une référence vraisemblable. Le contrôle qualité classique, relecture du raisonnement et de la cohérence argumentative, ne détecte rien, puisque le raisonnement est cohérent. Mirage News rapporte par ailleurs une étude de l'Université d'Arizona, publiée dans Scientific Reports, qui a évalué sept modèles génératifs lors de conversations longues et mesure leur vulnérabilité aux fausses informations répétées : la fragilité s'accroît donc avec la durée de l'échange.
La seule barrière efficace est donc la vérification d'existence, opération distincte de la relecture. Elle consiste à remonter chaque référence jusqu'à la source primaire et à constater que le document existe, qu'il dit ce qu'on lui fait dire, et qu'il est toujours en vigueur. Cette opération n'a rien de nouveau pour un documentaliste juridique. Ce qui est nouveau, c'est le volume de références plausibles qu'un outil produit en quelques secondes, et donc le déséquilibre entre le coût de la production et le coût du contrôle.
Un texte peut être entièrement cohérent et entièrement sans référent. La cohérence interne n'a jamais été une preuve d'existence.
Pourquoi la fonction de juger résiste à l'automatisation
Affirmer que juger reste une fonction humaine, comme le fait la directive rapportée par Le Canada Français, revient à décrire ce que fait un juge et qui n'est pas réductible à une production de texte. Juger suppose d'apprécier la crédibilité d'un témoignage, de pondérer des intérêts qui ne sont pas commensurables, d'assumer publiquement une décision et d'en répondre. Aucune de ces opérations n'est un problème de génération de langage, même si toutes se traduisent en fin de compte par du langage.
Cette distinction éclaire par contraste ce qui reste légitimement outillable. La recherche documentaire préalable, la constitution d'un corpus de décisions comparables, la détection de l'existence d'une controverse doctrinale sur un point donné : ces tâches sont des tâches de repérage, et le repérage supporte l'assistance automatique dès lors que sa production est vérifiable. Le critère de partage n'est pas la difficulté de la tâche, il est la possibilité de contrôler le résultat contre une source qui existe indépendamment de l'outil.
Les organisations qui transposent ce raisonnement à leur propre production documentaire arrivent à une règle simple. Un livrable dont chaque affirmation extérieure renvoie à un document identifiable supporte l'assistance générative sur sa rédaction. Un livrable qui porte un jugement engageant la responsabilité de son auteur, note d'alerte, recommandation d'arbitrage, qualification d'un risque, ne la supporte pas sur sa conclusion. La frontière passe entre le travail de rassemblement et l'acte d'apprécier.
Ce que la directive change pour la veille réglementaire des organisations
La première conséquence est un élargissement du périmètre à surveiller. Une veille réglementaire calibrée sur les sources normatives officielles ne voit pas passer une directive émise par les juges en chef à destination des juges. Or ce texte produit des effets pratiques immédiats sur la façon dont les dossiers sont instruits. Le périmètre pertinent inclut désormais les prises de position des ordres professionnels, des autorités internes des juridictions et des instances déontologiques, qui publient sur leurs propres canaux et selon leur propre calendrier.
La deuxième conséquence porte sur le délai de détection. Les relevés publiés par l'Observatoire de l'Intelligence Économique montrent que l'écart entre la mise en ligne d'un texte professionnel de ce type et sa prise en compte effective dans les processus internes d'une organisation se compte couramment en semaines, alors qu'il se compte en jours pour un texte paru au journal officiel. L'écart ne s'explique pas par la difficulté du texte mais par l'absence de canal de captation dédié.
La troisième conséquence est d'outillage. Couvrir un périmètre hétérogène de sources qui n'ont ni format commun ni rythme de publication commun suppose une surveillance continue et une remontée triée. NewsCore (www.newscore.fr) couvre en continu des millions de sources en plusieurs langues, trie les signaux par pertinence et conserve le lien vers le document d'origine, ce qui raccourcit nettement le délai entre la publication d'une directive professionnelle et son arrivée sur le bureau du responsable conformité. La qualification finale du texte, elle, reste le travail de l'équipe qui connaît son organisation.
Les signaux à surveiller dans les mois qui viennent
Le premier signal est la diffusion du modèle. Une magistrature qui encadre l'usage de l'IA générative crée un précédent institutionnel que d'autres professions réglementées observent : notariat, expertise comptable, professions de santé, professions du chiffre. La question à suivre n'est pas de savoir si ces encadrements viendront, mais quelle formulation ils retiendront, car c'est la formulation qui détermine la portée pratique.
Le deuxième signal est le déplacement de la charge de preuve. Tant que l'usage d'un outil génératif reste implicite, la responsabilité d'une erreur documentaire est diluée. Dès qu'une directive existe, ne pas l'avoir suivie devient un manquement identifiable. Ce basculement transforme un risque diffus en risque qualifiable, ce qui intéresse les fonctions conformité et gestion des risques bien au-delà du secteur juridique.
Le même mouvement s'observe au niveau international. Philstar rapporte que la défense de l'ancien président philippin Rodrigo Duterte a demandé à la Cour pénale internationale de renforcer les protocoles de vérification des preuves numériques, en invoquant la propagation de fausses informations en ligne, dans une requête datée du 31 août. La démarche vient d'un autre contexte, mais pose la même question : à quelles conditions un document numérique fait-il foi devant une juridiction.
Le troisième signal est technique. La vérification d'existence des références est une opération mécanisable, et l'apparition d'outils de contrôle systématique des citations constituerait une réponse structurelle à l'incident décrit par Le Canada Français. Suivre ce marché naissant relève de la veille technologique autant que de la veille réglementaire, les deux se rejoignant sur un même objet : la traçabilité documentaire.
Questions fréquentes
Pourquoi une directive interne à une magistrature concerne-t-elle des entreprises ?
Parce qu'elle fixe un standard de diligence documentaire qui déborde son secteur d'origine. Quand une institution aussi attentive au formalisme que la justice juge nécessaire d'écrire que la production d'un outil génératif doit être vérifiée avant d'être reprise, elle définit implicitement ce qu'un professionnel raisonnable est censé faire. Ce standard sert ensuite de référence ailleurs, notamment pour apprécier si une organisation a pris les précautions attendues avant de diffuser un document engageant.
Comment détecter une référence inexistante dans une note interne ?
En dissociant deux contrôles que l'on confond souvent. La relecture vérifie que le raisonnement tient ; la vérification d'existence vérifie que chaque source citée existe, dit ce qu'on lui attribue et reste en vigueur. Concrètement, il faut ouvrir chaque lien, retrouver chaque référence dans une base primaire et marquer les affirmations non sourcées. Une note dont aucune référence ne résiste à ce test ne doit pas circuler, quelle que soit la qualité de son argumentation.
Faut-il interdire l'IA générative dans les fonctions de veille ?
L'interdiction générale est une réponse mal calibrée, parce qu'elle traite de la même façon des usages de risque très différent. La ligne de partage utile est celle que trace la directive : l'outil assiste le rassemblement et la mise en forme, il ne produit pas l'appréciation finale ni les références. Une politique interne efficace autorise l'assistance sur les tâches vérifiables, impose la traçabilité de toute source citée, et réserve à un humain identifié la responsabilité de toute conclusion diffusée hors de l'équipe.