Extracteur d'emails, URLs et téléphones
Collez un texte et récupérez instantanément les adresses email, les liens et les numéros de téléphone français qu'il contient, triés et dédupliqués.
Emails (0)
Aucun résultat pour l'instant. Collez du texte ci-dessus.
Comment fonctionne l'extraction
Dès que vous collez ou tapez du texte dans la zone prévue, trois expressions régulières analysent le contenu en parallèle pour repérer les motifs correspondant à des adresses email, des liens web et des numéros de téléphone français. Le traitement est immédiat et se met à jour à chaque frappe, sans aucun appel réseau : tout se passe dans votre navigateur. Chaque catégorie de résultat est affichée dans son propre onglet avec un badge indiquant le nombre d'éléments trouvés, un bouton pour copier la liste complète dans le presse-papier et un bouton pour la télécharger sous forme de fichier .txt.
Les limites d'une extraction par expression régulière
Une extraction basée sur des motifs de texte reste une approximation pratique, pas une validation exhaustive. Pour les emails, l'outil utilise un motif courant qui couvre la grande majorité des adresses réelles mais ne reproduit pas intégralement la norme RFC 5322 : des adresses très inhabituelles peuvent ne pas être reconnues. Les emails volontairement obfusqués pour échapper aux robots (comme "contact (at) exemple point fr") ne sont pas détectés, car l'outil cherche un véritable caractère @ et non une reformulation textuelle. Pour les numéros de téléphone, une suite de dix chiffres qui n'est pas un numéro (une référence de commande par exemple) peut être confondue avec un téléphone si elle respecte le même format de séparateurs. Vérifiez toujours les listes extraites avant de les réutiliser dans un cadre professionnel ou sensible.
Dans quels cas utiliser cet outil
Cet extracteur est pratique lorsque vous recevez un texte non structuré - un export de conversation, un compte rendu de réunion, un email transféré avec plusieurs interlocuteurs en copie, une page web collée brute - et que vous avez besoin de récupérer rapidement les coordonnées qu'il contient sans les repointer une à une. Il convient par exemple pour reconstituer une liste de contacts à partir d'un document PDF collé en texte, pour vérifier quels liens figurent dans une newsletter avant de la relire, ou pour retrouver les numéros de téléphone dispersés dans un long fil de discussion. Comme tout se passe localement dans le navigateur, il peut aussi servir sur des textes contenant des informations confidentielles sans risque de transmission à un tiers. En revanche, ce n'est pas un outil de vérification : il ne teste pas si une adresse email existe réellement, ne vérifie pas qu'un lien répond, et ne confirme pas qu'un numéro de téléphone est attribué. Il se contente de repérer des motifs de texte qui ressemblent à ces trois types d'information, à vous de valider les résultats avant de les exploiter, en particulier si vous prévoyez de les importer dans un CRM, un outil d'emailing ou une base de contacts où les faux positifs auraient un coût.
Il utilise une expression régulière pratique qui couvre l'immense majorité des adresses réelles (lettres, chiffres, points, tirets, underscore avant l'arobase, puis un domaine avec extension). Ce n'est pas une implémentation complète de la norme RFC 5322 : certaines adresses valides mais très inhabituelles peuvent échapper à la détection, et inversement une chaîne qui ressemble à un email sans en être un pourrait être capturée.
Non. Si un email est écrit sous une forme obfusquée comme "nom(at)domaine.fr" ou "nom [arobase] domaine point fr" pour échapper aux robots, l'outil ne le reconnaîtra pas : il cherche un motif littéral avec un véritable caractère @, pas une reformulation textuelle.
Les liens commençant par http:// ou https:// sont toujours détectés. Les adresses commençant par www. ou ressemblant à un nom de domaine suivi d'une extension courante (.fr, .com, .net, etc.) sont également capturées par heuristique, mais cette heuristique peut manquer des domaines à extension rare ou, plus rarement, capturer par erreur une suite de caractères qui ressemble à un domaine sans en être un.
Les numéros français commençant par 0 suivi de 9 chiffres (avec ou sans espaces, points ou tirets comme séparateurs), ainsi que le format international +33 suivi du numéro sans le 0 initial. Les numéros étrangers hors format +33 ou les extensions/postes ne sont pas gérés.
Oui, c'est une limite connue des extractions par expression régulière sur texte libre. Une suite de 10 chiffres qui n'est pas un numéro de téléphone (un identifiant, une référence de commande, un numéro de sécurité sociale partiel...) peut être confondue avec un téléphone si elle respecte le même format. Vérifiez toujours les résultats avant de les réutiliser dans un contexte sensible.
Non. Toute l'extraction se fait localement dans votre navigateur via des expressions régulières exécutées en JavaScript. Aucune donnée saisie n'est transmise à un serveur.
Oui, chaque liste (emails, URLs, téléphones) élimine les doublons exacts. Pour les emails, la casse est normalisée en minuscules avant déduplication ; pour les URLs et téléphones, seule la chaîne exacte trouvée est comparée, donc deux écritures différentes d'un même numéro (avec ou sans espaces par exemple) peuvent apparaître comme deux entrées distinctes.