Une étude universitaire ayant testé des modèles d’intelligence artificielle sur 30 questions de droit islamique conclut que ces systèmes peuvent fournir des réponses correctes dans certains cas, mais qu’ils présentent des lacunes dans la compréhension du contexte, la restitution des divergences doctrinales et la citation des sources. Elle recommande de limiter leur usage à l’assistance au mufti et de soumettre toute fatwa validée à un examen humain et institutionnel.
Ces résultats figurent dans le mémoire de master du chercheur Omar Amer, intitulé « L’émission automatisée de fatwas entre approche juridique islamique et défis de la réception humaine : étude analytique et critique à l’ère de l’intelligence artificielle », présenté à la Faculté des lettres et des sciences humaines, section du fiqh et de ses fondements, à l’Université d’Afrique franco-arabe en République du Mali.
L’étude s’est appuyée sur des approches analytique, critique, prospective et finaliste. Elle a examiné les conditions requises pour l’émission d’une fatwa et pour l’exercice de la fonction de mufti en fiqh et dans ses fondements, ainsi que le fonctionnement des modèles intelligents. Dans son volet pratique, elle a soumis 30 questions à des modèles d’intelligence artificielle, puis comparé leurs réponses aux sources, aux règles et aux références du fiqh.
Erreurs et confusions entre domaines du fiqh
Lors de l’un des tests, le modèle GPT-3.5 Turbo Instruct a jugé permis l’essuyage sur les chaussettes, mais a ajouté le conseil d’utiliser une « substance antibactérienne » et d’autres formulations sans rapport avec la règle religieuse. À une question sur le regroupement des prières en raison de la pluie, il a inclus « la garde des enfants » parmi les situations autorisant ce regroupement, ce que l’étude a considéré comme une confusion entre différents domaines du fiqh.
Le mémoire a relevé d’autres erreurs sur la zakat des biens commerciaux, le mariage avec une femme du Livre et la récitation du qunût lors de la prière de l’aube. L’un des modèles a nié que la zakat soit obligatoire sur les biens commerciaux et l’a associée à l’impôt sur le revenu, tandis qu’un autre a interdit le mariage avec une femme du Livre et lui a dénié certains droits financiers.
Sur la question du qunût lors de la prière de l’aube, l’un des modèles a rendu un jugement catégorique en le qualifiant d’« innovation blâmable », sans faire apparaître la divergence entre les écoles juridiques exposée dans l’étude.
Des réponses correctes ne suffisent pas à appliquer la règle
L’étude souligne que les lacunes ne se limitent pas aux réponses erronées : une réponse peut être correcte dans son principe, mais insuffisante pour appliquer la règle à un cas précis. À une question sur le jeûne d’une personne diabétique, le modèle a lié sa permission à l’état de santé du patient, tandis que le mémoire explique que la règle peut changer si les médecins établissent l’existence d’un danger, ce qui rend nécessaire la connaissance des détails du cas.
En revanche, l’étude a relevé des réponses globalement correctes sur plusieurs questions contemporaines. Interrogé sur l’utilisation de l’intelligence artificielle pour déterminer les intérêts des prêts, l’un des modèles a indiqué que la technologie ne modifiait pas le statut juridique des intérêts eux-mêmes.
Le modèle Bard a exigé que l’organisme soit digne de confiance et que les fonds parviennent bien à leurs bénéficiaires lors du paiement de la zakat via des applications, l’étude notant toutefois que la réponse ne traitait pas de la condition de l’intention.
Rapidité de recherche et lacunes dans la compréhension des circonstances
Le mémoire a identifié parmi les points forts des modèles leur rapidité de réponse et de recherche, leur capacité à classer les informations et à fournir une couverture générale de certaines questions, ainsi que leur mention occasionnelle des divergences et de la nécessité de consulter des spécialistes. Il a toutefois relevé un manque de précision sur les écoles juridiques, une confusion entre les différents degrés de normativité et une faiblesse dans la citation des sources, ainsi que la difficulté à prendre en compte l’intention du demandeur et sa situation médicale, familiale ou juridique.
Une formulation structurée et assurée peut donner aux réponses incertaines ou erronées une « certitude artificielle » et inciter l’utilisateur à les traiter comme un jugement définitif. L’étude
L’étude a également soulevé la question de la responsabilité en cas d’erreur, alors que plusieurs parties pourraient être impliquées : le développeur, l’entreprise, la plateforme, l’utilisateur et l’entité ayant fourni les informations au système.
Un rôle d’assistance sous supervision humaine
Le mémoire conclut que l’intelligence artificielle ne possède pas la capacité juridique islamique requise pour exercer la fonction de mufti et qu’elle n’assume pas la responsabilité morale et religieuse du jugement rendu.
Il propose de limiter son rôle à la collecte des preuves, à l’indexation des fatwas, à l’archivage des questions, à la recherche dans les sources et au classement des avis, sous la supervision d’instances religieuses, avec des bases de connaissances fiables, un contrôle humain obligatoire et un avertissement clair précisant que la réponse automatisée n’est pas une fatwa officielle.