Calculateur VPP / VPN : pourquoi votre test positif peut être faux
Un simulateur : trois curseurs, 1 000 patients, et une question que tout médecin finit par rencontrer.
Sensibilité (Se)
Sur 100 personnes malades, combien le test détecte. À 99 % : un malade sur cent passe entre les mailles.
Spécificité (Sp)
Sur 100 personnes saines, combien le test écarte correctement. À 99 % : une fausse alerte pour cent sains.
Prévalence
La fréquence de la maladie parmi les personnes testées. Absente de la notice - car elle ne décrit pas le test. Et c'est elle qui change tout.
La situation
Vous êtes le médecin. Un patient d'un groupe à faible risque passe un test de dépistage. Vous connaissez le test : il détecte 99 malades sur 100 (Se = 99 %) et écarte 99 sains sur 100 (Sp = 99 %). Vous savez aussi que la maladie est rare : environ 1 personne sur 1 000. Le résultat revient positif. La question à laquelle vous devez répondre, avant de dire un mot au patient : quelle est la probabilité qu'il soit réellement malade ?
Mode d'emploi
Ci-dessous, 1 000 points - un par personne testée. Les curseurs règlent la fréquence de la maladie et la qualité du test ; les points montrent qui le test signale. Commencez par les préréglages, puis poussez les curseurs aux extrêmes.
Test positif
Test négatif
Le même résultat présenté en tableau - le 2×2 auquel se ramène chacun de ces problèmes :
| Malades | Sains | Total | |
|---|---|---|---|
| Test + | |||
| Test − | |||
| Total | 1000 |
Le tableau 2×2
Chaque résultat tombe dans l’une de quatre cases. Les colonnes sont la vérité (malade ou non), les lignes ce qu’a dit le test.
La VPP se lit sur la première ligne : VP / (VP + FP) - parmi tous les positifs, la part réellement malade.
Sensibilité, spécificité, VPP, VPN : quelle différence ?
C’est la confusion sur laquelle repose tout le chapitre, et les curseurs ci-dessus viennent d’en donner la réponse. La sensibilité et la spécificité sont des propriétés du test. Elles décrivent ce que le test fait à un groupe déjà trié selon la vérité, et elles ne bougent pas quand la maladie se raréfie. Les valeurs prédictives ne sont pas des propriétés du test. Elles décrivent ce qu’un résultat signifie pour la personne en face de vous, et elles dépendent de la fréquence de la maladie chez les gens que l’on teste.
Voici le même test — une mammographie, sensibilité 90 %, spécificité 91 % — déplacé dans quatre contextes. Rien ne change dans le test lui-même. Regardez les deux colonnes de gauche rester immobiles et les deux de droite bouger.
| Qui est testé | Prévalence | Se | Sp | VPP | VPN |
|---|---|---|---|---|---|
| Dépistage d’une maladie rare | 0,1 % | 90 % | 91 % | 1,0 % | 100,0 % |
| Mammographie de dépistage | 1 % | 90 % | 91 % | 9,2 % | 99,9 % |
| Patiente symptomatique | 10 % | 90 % | 91 % | 52,6 % | 98,8 % |
| Forte suspicion clinique | 50 % | 90 % | 91 % | 90,9 % | 90,1 % |
Sensibilité et spécificité : identiques sur les quatre lignes. VPP : de 1 % à 91 % — un facteur 92. Le même test, les mêmes chiffres sur la notice, et quatre sens complètement différents du mot « positif ».
Alors pourquoi la rareté de la maladie fait-elle autant basculer la réponse ? Voici le raisonnement en mots, puis la formule.
Ce que les chiffres veulent dire
La sensibilité et la spécificité répondent à une question directe : si une personne est malade, à quelle fréquence le test le dit-il ? Votre patient pose la question inverse : compte tenu de ce résultat positif, suis-je réellement malade ? Cette réponse inverse est la valeur prédictive positive (VPP), et contrairement à la sensibilité ou la spécificité, elle dépend de la prévalence, la fréquence de la maladie dans le groupe testé. Le test ne peut pas la connaître ; le test seul ne peut donc pas répondre à votre patient.
p est la prévalence, la probabilité pré-test.
Il existe une astuce qui rend tout cela évident, et c’est celle qui manquait aux médecins interrogés : raisonner en personnes, pas en pourcentages. « Dix sur mille, le test en détecte neuf » est compréhensible par tous ; « 90 % de sensibilité à 1 % de prévalence » cache la réponse. Chaque fois qu’un problème de test paraît glissant, reconstruisez-le en une foule de 1 000 personnes, c’est exactement ce que font les points ci-dessus.
Si vous venez du machine learning : la VPP est exactement ce que vous appelez precision, et la sensibilité est le recall. Mêmes maths, autre examen.
Le meilleur moyen de comprendre : en résoudre un à la main
Énoncé
Une femme de 50 ans passe une mammographie de dépistage de routine. Dans sa tranche d’âge, environ 1 femme sur 100 a un cancer du sein au moment du dépistage. La mammographie détecte environ 90 % des cancers (sensibilité) et donne un faux positif chez environ 9 % des femmes saines (spécificité 91 %). Son résultat est positif. Quelle est la probabilité qu’elle ait un cancer ?
Ne commencez pas par les pourcentages. Commencez par 1 000 femmes comme elle :
• Environ 990 sont saines. Environ 9 % ont un faux positif : 89 faux positifs.
• Donc environ 98 femmes sont positives, et 9 seulement ont réellement un cancer.
VPP = 9 / 98 ≈ 9 %.
La formule confirme, bien sûr :
Questions fréquentes
Pourquoi un test fiable à 99 % peut-il se tromper la plupart du temps ?
Parce que la fiabilité ignore la rareté de la maladie. Quand la prévalence est basse, les rares vrais positifs sont noyés sous les faux positifs issus de la vaste majorité de gens sains, si bien qu'un résultat positif peut être plus souvent faux que vrai. C'est la prévalence, pas la fiabilité affichée du test, qui détermine la valeur prédictive.
Quelle est la différence entre la sensibilité et la VPP ?
La sensibilité est fixée par le test : parmi les malades, la part qu'il détecte. La VPP va dans l'autre sens et dépend de la prévalence : parmi les positifs, la part réellement malade. Un test peut avoir 99 % de sensibilité et une VPP faible quand la maladie est rare.
La sensibilité et la spécificité dépendent-elles de la prévalence ?
Non. Ce sont des propriétés du test : elles décrivent son comportement chez des sujets déjà connus comme malades, ou déjà connus comme sains. Les valeurs prédictives, c’est l’inverse : la VPP et la VPN dépendent de la prévalence, parce qu’elles décrivent une population mêlée, dont le statut est inconnu. C’est pourquoi le même test peut avoir une VPP de 1 % en dépistage et de 91 % chez une patiente symptomatique.
Pourquoi la VPP dépend-elle de la prévalence ?
Parce que la VPP est la part de vrais positifs parmi tous les positifs, et que les faux positifs proviennent du groupe des sains. Quand la maladie est rare, ce groupe représente presque toute la population : même un faible taux de faux positifs produit alors plus de faux positifs qu’il n’existe de vrais malades. Rendez la maladie fréquente et l’arithmétique s’inverse.
Comment calcule-t-on la valeur prédictive positive ?
La VPP, c'est les vrais positifs divisés par l'ensemble des positifs. En fonction du test, la VPP vaut la sensibilité fois la prévalence, divisé par ce même terme plus un-moins-spécificité fois un-moins-prévalence.
Ceci est un seul piège de l'intuition. La section Paradoxes & Intuition Traps de Stat Exam Pro en contient toute une série : des QCM type examen, corrigés et expliqués, en français et en anglais.
Télécharger sur iPhone