Analyse
bioinformatique des séquences
5. - La comparaison de séquences
5.2 - La notion de similarité, d'identité et d'homologie
Il existe plusieurs termes permettant de nommer la ressemblance entre deux séquences biologiques. La similarité est une quantité qui se mesure en % d'identité, identité elle même définie comme une ressemblance parfaite entre deux séquences.
L'homologie quand à elle est une propriété de séquences qui a une connotation évolutive. Deux séquences sont dites homologues si elles possèdent un ancêtre commun. L'homologie présente la particularité d'être transitive. Si A est homologue à B et B homologue à C, alors A est homologue à C même si A et C se ressemblent très peu.
L'homologie se mesure par la similarité. On considère qu'une similarité significative est signe d'homologie sauf si les séquences présentent une faible complexité. L'inverse n'est par contre pas vrai. Une absence totale de similarité ne veut pas dire non-homologie.