Pourquoi les modèles de langage généralistes peinent en droit français
Les grands modèles de langage produisent en droit français des réponses fluides, mais pas toujours exactes. Leurs biais sont d’autant plus difficiles à déceler que les réponses sont bien rédigées.
La rédaction d’Actelyo 4 min de lecture
Des catégories venues d’ailleurs
Les modèles de langage généralistes ont été entraînés sur des corpus où les textes anglophones et les notions de common law occupent une place prépondérante. Interrogés sur des institutions propres au droit français (réserve héréditaire, régimes matrimoniaux, société civile immobilière, acte authentique), ils tendent à rapprocher ces notions de catégories étrangères voisines, au prix de glissements de qualification. D’autres biais s’y ajoutent : chercher un précédent décisif plutôt que partir du texte applicable, confondre une norme avec un commentaire, répondre selon un état du droit dépassé.
Un texte probable, pas un raisonnement
Ces modèles produisent le texte le plus probable, non un raisonnement fondé sur la hiérarchie des normes, et leurs connaissances s’arrêtent à la date de leur entraînement. Ils peuvent citer des articles ou des décisions inexacts, voire inexistants. Le danger tient à un effet de masque : plus la réponse est fluide, plus la vigilance diminue. Relier le modèle à une base documentaire à jour, dont chaque source est identifiable, réduit ce risque sans le supprimer.
À retenir
- Vérifier une à une les références produites par un outil d’IA avant tout usage.
- Redoubler de vigilance dans les matières sans équivalent en common law.
- Exiger de l’outil qu’il parte du texte applicable et cite ses sources.
- Distinguer, dans les documents consultés, les textes, la jurisprudence, la doctrine et les documents internes.
- Garder une supervision humaine systématique sur les usages sensibles.
Cet article donne des repères généraux ; il ne constitue pas un avis juridique. Les textes cités sont à vérifier dans leur version en vigueur.