Calculateur d'indice de similarité de Sørensen-Dice
Rédigé par Thierno Sadou Diallo, formule vérifiée selon notre méthodologie • Mis à jour le 06/09/2026
L'indice de Sørensen-Dice se calcule avec (2 × intersection) ÷ (taille A + taille B). Pour deux échantillons de 10 et 15 espèces partageant 5 espèces communes, l'indice vaut 0,4, soit 40 % de similarité.
Explication
L'indice de Sørensen-Dice mesure, comme l'indice de Jaccard déjà publié sur ce site, le degré de recouvrement entre deux ensembles (deux relevés de communautés écologiques, deux listes d'espèces). La différence tient à la formule elle-même : Sørensen-Dice compte l'intersection deux fois au numérateur et divise par la somme des tailles des deux échantillons, plutôt que par leur union. Ce choix accorde un poids plus important aux éléments partagés, ce qui donne systématiquement un résultat égal ou supérieur à l'indice de Jaccard pour les mêmes données — la différence est nulle seulement quand les deux échantillons sont identiques ou totalement disjoints, et maximale pour des échantillons partiellement recouvrants. Le résultat varie, comme pour Jaccard, entre 0 (aucun élément commun) et 1 (échantillons identiques). Le choix entre les deux indices dépend souvent de la convention du domaine ou de la publication de référence suivie plutôt que d'une supériorité universelle de l'un sur l'autre : l'écologie végétale utilise historiquement plus souvent Sørensen-Dice, tandis que Jaccard reste plus répandu en science des données générale. Pour une mesure qui tient compte de l'ABONDANCE de chaque espèce plutôt que de sa seule présence, voir notre calculateur de dissimilarité de Bray-Curtis.
Exemple : deux échantillons de 10 et 15 espèces, 5 en commun
Données d'entrée
Échantillon A : 10 espèces. Échantillon B : 15 espèces. Espèces communes : 5.
Calcul
Somme des tailles = 10 + 15 = 25. Indice de Sørensen-Dice = (2 × 5) ÷ 25 = 10 ÷ 25 = 0,4, soit 40 %.
Résultat
Les deux échantillons partagent 40 % de similarité selon l'indice de Sørensen-Dice.
Questions fréquentes
Pourquoi Sørensen-Dice donne-t-il toujours un résultat supérieur ou égal à Jaccard ?
Parce que son numérateur compte l'intersection deux fois, tandis que son dénominateur (la somme des tailles) est toujours inférieur ou égal à l'union utilisée par Jaccard (la somme des tailles moins l'intersection compterait l'union, donc la somme des tailles est toujours ≥ union). Cette combinaison d'un numérateur plus grand et d'un dénominateur plus petit ou égal fait que Sørensen-Dice ne peut jamais être inférieur à Jaccard pour les mêmes données.
Quel indice utiliser, Jaccard ou Sørensen-Dice ?
Les deux mesurent une notion très proche de similarité, et le choix dépend surtout de la convention du domaine d'étude ou de la nécessité de comparer un résultat à des publications antérieures utilisant l'un ou l'autre. Il n'existe pas de consensus universel indiquant que l'un serait toujours préférable : l'important est de rester cohérent et de préciser lequel des deux est utilisé lors de la présentation des résultats.
Cet indice s'applique-t-il uniquement à l'écologie ?
Non, comme l'indice de Jaccard, c'est une mesure de théorie des ensembles également utilisée en bio-informatique (comparaison de séquences génétiques), en traitement du texte (comparaison de documents) et en science des données au sens large, au-delà du seul contexte des communautés écologiques.