Pourcentage de similarité entre deux textes

Comparez deux textes et obtenez leur pourcentage de similarité ainsi que la distance d'édition (nombre de caractères à modifier pour passer de l'un à l'autre).

Exemple :

Comment ça marche

L'outil calcule la distance de Levenshtein entre les deux textes : le nombre minimal d'insertions, suppressions ou substitutions de caractères nécessaires pour transformer le premier texte en le second. Ce nombre est ensuite converti en pourcentage de similarité, utile pour détecter des doublons de contenu, comparer deux versions d'un article ou vérifier si une réponse d'utilisateur correspond suffisamment à une réponse attendue.

Un pourcentage de 100% signifie-t-il que les textes sont identiques ?

Oui, une similarité de 100% correspond à une distance d'édition de 0, c'est-à-dire que les deux textes sont strictement identiques caractère par caractère (espaces et casse compris).

Pourquoi la casse ou les espaces changent-ils le résultat ?

La comparaison est sensible à la casse et aux espaces car elle travaille caractère par caractère sans normalisation préalable : « Bonjour » et « bonjour » sont donc considérés comme différents.

Traitement 100% local : les deux textes comparés ne quittent jamais votre navigateur, tout se calcule via WebAssembly sur votre appareil.