Interprétabilité
- Concept
- Avancé
- Transversal
- Toujours utilisé
En bref
L'interprétabilité est la capacité à comprendre, en termes clairs pour un humain, comment un modèle d'intelligence artificielle arrive à un résultat donné.
Définition complète
L’interprétabilité désigne la capacité intrinsèque d’un modèle d’intelligence artificielle à être compris par un humain, indépendamment de toute technique ajoutée après coup pour l’expliquer. Un modèle simple, comme un arbre de décision avec quelques règles claires, est naturellement interprétable : on peut suivre son raisonnement étape par étape. Un modèle très complexe, comme un grand réseau de neurones avec des millions de paramètres, est beaucoup moins interprétable par nature.
Par exemple, un modèle qui décide d’accorder une prime de fidélité selon une règle simple (« client depuis plus de 3 ans et plus de 5 achats ») est facilement interprétable : n’importe quel employé peut le vérifier à la main. Un modèle de deep learning qui prend la même décision à partir de centaines de variables combinées de façon complexe est beaucoup plus difficile à interpréter directement.
Attention : l’interprétabilité et l’IA explicable sont des notions proches mais différentes : l’interprétabilité concerne la transparence intrinsèque du modèle lui-même, tandis que l’IA explicable regroupe des techniques permettant d’expliquer, même après coup, un modèle qui n’est pas interprétable par nature.
À quoi ça sert
L’interprétabilité sert à choisir, dès la conception d’un projet d’intelligence artificielle, un modèle adapté au niveau de transparence réellement nécessaire pour l’usage visé. Pour certaines décisions sensibles, un modèle simple et interprétable peut être préférable à un modèle plus performant mais totalement opaque.
Elle aide aussi les équipes techniques et les décideurs à documenter précisément le fonctionnement d’un algorithme, ce qui devient de plus en plus attendu par les régulateurs et les clients dans les secteurs sensibles comme la santé, la finance ou le recrutement.
Enfin, elle permet d’arbitrer consciemment entre performance brute et compréhension du fonctionnement : ce compromis n’a pas de bonne réponse universelle, il dépend du contexte, du niveau de risque et des obligations légales propres à chaque projet.
Cas d'usage typiques
– Choisir : privilégier un modèle simple et transparent plutôt qu’un modèle complexe pour un usage à fort enjeu humain.
– Documenter : décrire précisément le fonctionnement d’un algorithme de notation interne pour un audit.
– Répondre : justifier auprès d’un régulateur le niveau de transparence d’un outil de scoring utilisé par l’entreprise.
– Former : apprendre à une équipe technique à comparer plusieurs modèles selon leur degré de transparence.
– Arbitrer : décider entre performance maximale et facilité de compréhension pour un projet d’intelligence artificielle sensible.
– Rassurer : présenter à une direction les risques et limites d’un modèle peu interprétable avant son déploiement.
Ce que tu sauras faire
Savoir distinguer un modèle intrinsèquement interprétable d'un modèle « boîte noire », et comprendre pourquoi ce choix technique a des conséquences concrètes sur la confiance et la conformité d'un projet d'intelligence artificielle.
Mises en situation
Situation 1 : une entreprise qui choisit un modèle pour la conformité
Contexte : Une compagnie d’assurance doit choisir entre deux modèles pour évaluer le risque des nouveaux contrats : un modèle simple à base de règles, et un modèle de deep learning légèrement plus précis mais très difficile à interpréter.
Application : Compte tenu des obligations réglementaires du secteur assurantiel, l’entreprise choisit le modèle plus simple, quitte à perdre un peu de précision brute.
Résultat attendu : L’entreprise peut justifier facilement chaque décision de tarification auprès de ses clients et des autorités de contrôle, ce qui réduit son risque juridique.
Situation 2 : un audit technique interne
Contexte : Une entreprise utilise depuis plusieurs années un algorithme de notation de ses fournisseurs sans jamais avoir documenté précisément son fonctionnement interne.
Application : Un audit technique est lancé pour évaluer le niveau réel d’interprétabilité de l’algorithme et documenter ses critères de décision.
Résultat attendu : L’entreprise obtient une documentation claire de son outil, ce qui lui permet de répondre plus facilement à d’éventuelles questions de ses fournisseurs ou de ses partenaires.
Situation 3 : un hôpital qui arbitre entre deux outils médicaux
Contexte : Un service hospitalier hésite entre deux outils d’aide au diagnostic : l’un légèrement plus précis mais opaque, l’autre un peu moins précis mais dont chaque recommandation peut être détaillée médicalement.
Application : L’équipe médicale privilégie l’outil interprétable, jugeant essentiel de pouvoir comprendre et vérifier chaque recommandation avant de l’intégrer à une décision médicale.
Résultat attendu : Les médecins gardent une confiance et un contrôle réels sur l’outil, ce qui facilite son adoption au quotidien malgré une performance brute légèrement inférieure.
Application guidée : comparer deux modèles selon leur transparence
Contexte : Un projet interne compare un modèle de régression simple, dont chaque variable a un poids clairement identifiable, à un modèle de deep learning plus précis de 6 points de pourcentage mais totalement opaque.
Question : Dans quel contexte professionnel choisirait-on plutôt le modèle simple, et dans quel contexte choisirait-on plutôt le modèle complexe ?
Résultat attendu : Pour une décision à fort enjeu humain (crédit, recrutement, santé) nécessitant une justification claire, le modèle simple et interprétable est souvent préférable malgré sa précision légèrement inférieure ; pour une tâche à faible enjeu individuel (par exemple optimiser un affichage publicitaire), la précision du modèle complexe peut primer sur son manque de transparence.
Application guidée : détecter un faux sentiment de compréhension
Contexte : Une équipe pense bien comprendre son modèle de recommandation car elle peut visualiser un graphique simplifié de son fonctionnement, alors que ce graphique ne représente qu’une infime partie de la complexité réelle du modèle.
Question : Cette équipe a-t-elle réellement un modèle interprétable ?
Résultat attendu : Non : un graphique simplifié ou une visualisation partielle donne une impression de compréhension qui peut être trompeuse si le modèle sous-jacent reste en réalité complexe et opaque ; il est important de distinguer une vraie interprétabilité du modèle d’une simple présentation pédagogique rassurante mais incomplète.
Pour bien le retenir
L'analogie
L’interprétabilité, c’est la différence entre lire la recette complète d’un plat et goûter un plat mystère en devinant ses ingrédients. Avec la recette sous les yeux, on comprend exactement comment le plat a été préparé et pourquoi il a ce goût. Sans elle, on peut apprécier le résultat, voire le trouver délicieux, sans jamais savoir précisément ce qui s’y trouve : c’est cette différence qui sépare un modèle interprétable d’un modèle « boîte noire ».
« Un modèle interprétable montre sa recette, un modèle opaque ne montre que le plat fini. »
Pièges à éviter
À ne pas confondre avec
Le premier piège est de confondre interprétabilité et explicabilité : la première désigne la transparence naturelle d'un modèle, la seconde regroupe des techniques permettant d'expliquer un modèle même lorsqu'il n'est pas interprétable par nature ; les deux notions se complètent mais ne sont pas identiques.
Un autre piège consiste à croire qu'un modèle interprétable est automatiquement fiable, ou qu'un modèle opaque est automatiquement dangereux : un modèle simple peut tout de même reproduire des biais présents dans les données, et un modèle complexe peut malgré tout être fiable dans son domaine d'usage.
Enfin, il ne faut pas se contenter d'une explication ou d'une visualisation partielle pour affirmer qu'un modèle est interprétable : une vraie interprétabilité suppose de pouvoir suivre le raisonnement dans son ensemble, pas seulement un extrait simplifié et rassurant.
Évolution historique
Apparition : Sujet de recherche depuis les années 1990 en statistique, fortement relancé depuis les années 2015-2020 avec le deep learning
Quels changements depuis l’arrivée de l’IA ?
Cette notion existait déjà en statistique bien avant l’essor de l’intelligence artificielle moderne, mais elle a pris une importance nouvelle avec la complexité croissante des modèles utilisés aujourd’hui.
Avant
Dans les années 1990-2000, les modèles statistiques classiques (régression, arbres de décision) étaient déjà valorisés pour leur transparence naturelle, à une époque où les modèles très complexes restaient rares en usage courant.
Aujourd’hui
La généralisation du deep learning et des grands modèles de langage depuis les années 2010-2020 a rendu le compromis entre précision et interprétabilité beaucoup plus visible et débattu, en particulier depuis que des réglementations comme le RGPD et l’AI Act européen encadrent l’usage de l’intelligence artificielle dans des décisions sensibles.
Évolution historique
Années 1990 : les modèles statistiques simples sont déjà valorisés pour leur transparence dans de nombreux secteurs.
Années 2000-2010 : apparition de modèles plus complexes, premiers débats sur le compromis entre précision et transparence.
Années 2015 : la généralisation du deep learning intensifie fortement le problème des modèles « boîte noire ».
Années 2020 : le cadre réglementaire européen pousse les entreprises à documenter davantage l’interprétabilité de leurs modèles.
Aujourd’hui : critère de choix technique à part entière, particulièrement surveillé dans la santé, la finance et le recrutement.
Simulateur