Comparateur de sorties IA en ligne
Collez deux réponses générées par une IA (deux modèles, ou deux versions d'un même prompt) et repérez en direct ce qui diffère entre elles.
−En résumé, la photosynthèse est le processus par lequel les plantes−convertissent la lumière du soleil en énergie chimique.−Elle se déroule dans les chloroplastes.+En résumé, la photosynthèse est le mécanisme par lequel les plantes+et certaines bactéries convertissent la lumière du soleil en énergie chimique.+Elle se déroule principalement dans les chloroplastes.+Le sous-produit de cette réaction est l'oxygène.
Pourquoi comparer deux sorties de LLM ?
Quand on teste plusieurs modèles de langage sur le même prompt, ou qu'on relance le même modèle après avoir légèrement modifié une instruction, il est utile de savoir précisément ce qui a changé dans la réponse plutôt que de relire deux pavés de texte en entier. Ce comparateur affiche les deux réponses côte à côte puis calcule les lignes ajoutées, supprimées et inchangées entre elles, comme un outil de diff de code appliqué à du texte généré par une IA.
C'est utile pour évaluer la stabilité d'un modèle d'une génération à l'autre, comparer le style ou le contenu de deux fournisseurs différents sur la même tâche, ou vérifier l'effet d'un changement de prompt sur la sortie produite. Le résultat reste une comparaison ligne par ligne, purement textuelle : il ne juge pas la qualité ou l'exactitude des réponses, seulement leurs différences de formulation.
Lire le résultat
Les lignes présentes uniquement dans la sortie A apparaissent barrées en rouge, celles propres à la sortie B apparaissent en vert, et les lignes identiques dans les deux réponses restent neutres. Le pourcentage de similarité affiché au-dessus du résultat est une approximation : il rapporte le nombre de lignes identiques au nombre total de lignes, sans analyser le sens des phrases.
Il compare deux textes générés par un LLM — par exemple la réponse d'un modèle A et celle d'un modèle B au même prompt, ou deux réponses successives du même modèle après une reformulation — pour repérer rapidement ce qui a changé entre les deux, ligne par ligne.
L'outil découpe les deux sorties en lignes et calcule le plus long sous-ensemble de lignes communes (algorithme LCS), comme un diff Git classique. Les lignes qui n'en font pas partie sont marquées ajoutées ou supprimées.
Non, c'est une approximation purement mécanique : le rapport entre le nombre de lignes identiques et le nombre total de lignes. Deux réponses qui disent la même chose avec des mots différents, ou reformulées phrase par phrase, obtiendront un score de similarité faible même si le sens est proche. Ce n'est pas une comparaison sémantique.
Oui : deux lignes ne sont considérées identiques que si elles sont rigoureusement les mêmes, caractère pour caractère. Un simple reformatage (retour à la ligne différent, espace en trop) peut faire apparaître une ligne comme modifiée alors que le contenu est proche.
Non. La comparaison se fait entièrement en JavaScript dans votre navigateur. Les deux sorties collées ne sont jamais transmises à un serveur, ni analysées par un modèle, ni stockées.
Oui, mais le calcul du diff devient plus lent pour de très longs textes : au-delà de 4000 lignes par sortie, l'outil désactive le calcul en direct pour éviter de bloquer le navigateur.