E-mails uit tekst halen

Plak een reeks berichten, een CSV-kolom, een forumtopic of een stuk HTML, en de extractor haalt er elk e-mailadres uit dat hij kan herkennen. De uitvoer wordt ontdubbeld en is klaar om in je CRM-import of een bounce-checktool te plakken. De herkenning dekt de praktische deelverzameling van RFC 5322 (plus-adressering, punten in het lokale deel, koppeltekens in het domein) zonder de valse positieven die eenvoudige a@b-regex-patronen opleveren.

Zo haal je e-mails uit tekst

  1. 1

    Plak je bron

    Zet er vrije tekst, logbestanden, een HTML-pagina of een geëxporteerde contactlijst in, alles wat `local@domain.tld`-patronen bevat.

  2. 2

    Start de extractor

    De regex scant naar volledige adressen en negeert de leestekens eromheen.

  3. 3

    Bekijk het aantal

    Je krijgt het aantal gevonden unieke adressen plus de volledige lijst.

  4. 4

    Kopieer de lijst

    Kopieer naar het klembord als een lijst met één adres per regel, of plak direct in een kolom van een spreadsheet.

Wat telt als een geldig e-mailadres

De extractor volgt de praktische vorm van een e-mailadres in plaats van de volledige RFC 5322-grammatica, omdat die volledige grammatica adressen toestaat die geen enkele moderne MTA accepteert (lokale delen tussen aanhalingstekens met spaties, commentaar tussen haakjes). Dit is wat de matcher dekt:

Patroonelement Geaccepteerd Afgewezen
Lokaal deel a-z 0-9 . _ % + - spaties, tekst tussen aanhalingstekens, punthaken
Domein a-z 0-9 . - afsluitende punt, underscore in een label
TLD 2+ ASCII-letters uitsluitend numerieke TLD

Veelvoorkomende rommelige invoer die hij aankan

  • Adressen gevolgd door . of , in zinnen, het leesteken wordt niet meegenomen.
  • E-mails binnen mailto:-hrefs, het schema wordt automatisch verwijderd.
  • HTML-entiteiten zoals @ worden niet gedecodeerd, dus een adres als info@example.com wordt niet herkend.
  • Adressen tussen <punthaken> uit e-mailheaders.

Wat je met de uitvoer doet

  • Bezorgbaarheidscontrole. Haal de lijst door een bounce-checkdienst voordat je importeert, verzamelde lijsten bevatten vaak zo’n 10% dode adressen.
  • Toestemming. Dat een adres in een document voorkomt, betekent niet dat de persoon toestemming heeft gegeven om benaderd te worden. Controleer de AVG of de lokale wetgeving voordat je contact opneemt.
  • Ontdubbel ook op het lokale deel. john@gmail.com en j.ohn@gmail.com komen bij Gmail in dezelfde mailbox terecht; normaliseer de punten als je echt unieke identiteiten nodig hebt.

Veelgestelde vragen

Nee. De extractor richt zich op echte, verwerkbare adressen. Ontsluier de versluierde vormen eerst, of bewerk de tekst vooraf om [at] te vervangen door @ en [dot] door ..

Nee. De herkenning leest alleen basis Latijnse letters, dus müller@straße.de wordt niet herkend. Converteer het adres eerst naar de ASCII-punycode-vorm, bijvoorbeeld user@xn--strae-oqa.de.

Nee, er is geen optie om dubbele adressen te behouden. De uitvoer wordt ontdubbeld en behoudt de volgorde van het eerste voorkomen. Wil je vermeldingen tellen, tel ze dan in de brontekst.

Nee. De tekst wordt voor jouw verzoek verwerkt en niet in een database opgeslagen, niet gelogd en niet aan de paginalink toegevoegd.

Gerelateerde tools

Tool beschikbaar in andere talen