Indice de fidélité (Phi)
La fidélité mesure à quel point un taxon est caractéristique d’un groupe de colonnes (SyE) par rapport à l’ensemble du tableau. Un taxon très fidèle est concentré dans un SyE et rare (ou absent) ailleurs : c’est un bon candidat comme espèce différentielle ou caractéristique.
VegLab calcule pour cela le coefficient Phi (Tichý & Chytrý 2006), un indice statistique d’association. Il est calculé pour chaque taxon et chaque SyE, puis affiché dans les cellules des colonnes synthétiques.
Ce que mesure le coefficient Phi
Le coefficient s’appuie sur quatre effectifs :
N: nombre total de relevés du tableau ;
Nₚ: nombre de relevés du SyE considéré ;
n: nombre total de relevés du tableau contenant le taxon ;
nₚ: nombre de relevés du SyE contenant le taxon.
$$\phi = \frac{N\,n_p - n\,N_p}{\sqrt{n\,N_p\,(N-n)\,(N-N_p)}}$$
La valeur est comprise entre −1 et +1. Dans VegLab, elle est affichée multipliée par 100 (convention usuelle), donc sur une échelle de −100 à +100:
proche de +100: le taxon est très fidèle au SyE (présent surtout, voire uniquement, dans ce groupe) ;
proche de 0: pas d’association particulière (le taxon est réparti comme le hasard le voudrait) ;
valeur négative: le taxon évite le SyE (il est présent surtout ailleurs).
La cellule reste vide lorsque l’indice n’est pas défini statistiquement (par exemple si le taxon est présent dans tous les relevés, ou s’il n’y a qu’un seul SyE) ou lorsque le taxon est absent du SyE.
Choisir la valeur affichée dans les colonnes synthétiques
Un sélecteur « Indice » dans la barre d’outils du tableau permet de choisir ce qu’affichent les colonnes synthétiques:
Coef: le coefficient de présence (chiffre romain
+,I…V) — affichage par défaut ;Fréquence: le pourcentage de présence du taxon dans le SyE ;
Fidélité φ: le coefficient Phi (×100) ;
Fidélité φ std.: le coefficient Phi standardisé (×100) — voir « Fidélité standardisée » plus bas.
Le mode d’affichage choisi est mémorisé avec le tableau: si vous enregistrez un tableau en vue « Fidélité φ », il se rouvrira automatiquement dans cette même vue lors du prochain chargement.
En mode Fidélité φ, les taxons diagnostiques sont mis en évidence par un fond vert dont l’intensité croît avec la fidélité : seules les valeurs de φ au‑dessus d’un seuil (par défaut 25) sont colorées, en trois paliers (vert clair → vert soutenu). Les fidélités faibles ou négatives ne sont pas colorées ; leur valeur reste néanmoins affichée dans la cellule.
Mise à jour automatique
L’indice se recalcule automatiquement dès que le tableau change : ajout ou suppression de relevés, déplacement d’un relevé d’un SyE à un autre, etc. Vous voyez donc la fidélité évoluer en temps réel au fil de vos réorganisations, comme les autres valeurs synthétiques.
Les valeurs sont enregistrées avec le tableau. À la réouverture d’un tableau déjà sauvegardé, elles sont relues telles quelles ; elles ne sont recalculées que lorsqu’elles sont absentes (ancien tableau, ou modification du tableau).
SyE sans relevés (tableaux synthétiques)
Un tableau synthétique (ou synoptique) est composé de colonnes qui ne contiennent pas de relevés individuels, mais résument chacune une unité de végétation (un ensemble de relevés). VegLab sait tout de même y estimer la fidélité.
Pour une telle colonne, deux informations sont exploitées : son effectif nominal Nₚ (le nombre de relevés que la synthèse représente, saisi à l’import) et la fréquence de chaque taxon (déduite de son coefficient). On estime alors le nombre de présences nₚ, puis φ :
$$n_p \approx \frac{\text{fréquence} \times N_p}{100} \qquad \phi = \frac{N\,n_p - n\,N_p}{\sqrt{n\,N_p\,(N-n)\,(N-N_p)}}$$
où N et n sont les sommes des effectifs et des présences sur toutes les colonnes du tableau.
Comme la fréquence d’un taxon y est elle-même approchée (centre de la classe de son coefficient), la fidélité obtenue est une estimation. Pour ne pas la confondre avec une valeur exacte (calculée sur de vrais relevés), elle est affichée en italique.
Lignes agrégées
Lorsque plusieurs taxons (lignes) sont agrégés en une seule ligne, la fidélité — comme la fréquence et le coefficient — porte sur l’ union des taxons regroupés : le taxon agrégé est considéré présent dans un relevé dès qu’ au moins un des taxons regroupés y est présent (une co-occurrence dans un même relevé ne compte qu’une fois).
Pour un SyE synthétique (sans relevés), les co-occurrences sont inconnues : la fréquence de l’agrégat est estimée par le maximum des fréquences des taxons regroupés (l’agrégat est présent au moins aussi souvent que son taxon le plus fréquent) — c’est donc une estimation, affichée en italique comme les autres valeurs d’un SyE synthétique.
Ces valeurs agrégées sont enregistrées avec le tableau; la dissociation restaure les valeurs d’origine de chaque taxon.
Fidélité standardisée
Le coefficient Phi « standard » présente un biais connu : sa valeur dépend de la taille relative du SyE. Un même profil de présence/absence donne un φ plus élevé pour un petit SyE que pour un grand, si bien que les fidélités ne sont pas directement comparables entre unités de tailles inégales — ce qui est fréquent dans un tableau synthétique.
La variante standardisée (Tichý & Chytrý 2006, « …for site groups of unequal size ») corrige ce biais : elle ramène virtuellement tous les SyE à une même taille cible g, exprimée en pourcentage de l’effectif total du tableau. Les fidélités redeviennent alors comparables d’une colonne à l’autre, quelle que soit leur taille réelle.
$$\phi_ = \frac{\sqrt{g\,(1-g)}\;(f_p - f_o)}{\sqrt{n'\,(1-n')}} \qquad n' = g\,f_p + (1-g)\,f_o$$
où $f_p = n_p/N_p$ est la fréquence du taxon dans le SyE et $f_o = (n-n_p)/(N-N_p)$ sa fréquence hors du SyE (mêmes notations que pour le φ standard).
Quand ce mode est actif, un champ « Taille cible (%) » apparaît à côté du sélecteur « Indice ». Il est pré-rempli à 100 / (nombre de SyE) — l’égalisation « toutes les colonnes à la même taille », le choix le plus neutre — et reste modifiable: le tableau se recolorie en direct et la valeur choisie est enregistrée avec le tableau.
Limites de cette version
Sur un SyE synthétique, la fidélité est une estimation (voir ci-dessus), signalée en italique. Dans un tableau mixte (colonnes de relevés réels + colonnes synthétiques), la fidélité des colonnes de relevés est elle aussi légèrement estimée, car elle intègre les effectifs nominaux des colonnes synthétiques.
Référence
Tichý, L. & Chytrý, M. (2006). Statistical determination of diagnostic species for site groups of unequal size. Journal of Vegetation Science, 17 : 809‑818.