PDF-naar-tekst-converter

Volgende: controleren

De snelste manier om de woorden uit een PDF te halen. Deze tool leest de tekstlaag die al in de PDF is opgeslagen, pagina voor pagina, en geeft je platte tekst die je kunt kopiëren of opslaan als .txt-bestand. Alles draait in je browser, dus je document wordt nooit geüpload. Eén ding om vooraf te weten: de tool leest tekst die al in het bestand zit, dus een gescand of gefotografeerd document (een afbeelding zonder tekstlaag) komt er leeg uit. Gebruik daarvoor in plaats daarvan een OCR-tool.

Tekst uit een PDF halen

  1. 1

    Upload de PDF

    Sleep hem erin of klik om te bladeren. Het bestand blijft op je apparaat en wordt nooit naar een server gestuurd.

  2. 2

    Haal de tekst eruit

    De tool leest de tekstlaag van elke pagina en voegt ze samen, met een markering voor elke pagina.

  3. 3

    Bekijk het resultaat

    De opgehaalde tekst verschijnt in een vak, pagina na pagina, klaar om te controleren.

  4. 4

    Kopieer of download

    Kopieer het naar het klembord of sla het op als .txt-bestand om elders opnieuw te gebruiken.

Wat deze tool leest, en wat niet

Soort PDF Resultaat
Geëxporteerd uit Word, Google Docs, een browser of een ontwerptool Volledige tekst, schoon en compleet
Een digitale PDF met een echte tekstlaag Tekst pagina voor pagina opgehaald
Een scan of foto opgeslagen als PDF (alleen afbeelding) Leeg of bijna leeg: er is geen tekst om te lezen
Een met een wachtwoord beveiligde PDF Niet leesbaar totdat je hem eerst ontgrendelt

Geen OCR hier: de juiste tool voor scans

Deze extractor voert geen OCR (optische tekenherkenning) uit. Hij kopieert de tekst die al in de PDF zit, hij leest geen pixels. Als je bestand een scan is en je krijgt niets terug, haal het dan eerst door een OCR-tool, dat de afbeelding omzet in een echte tekstlaag die je daarna kunt ophalen.

Hoe de tekst is opgebouwd

Elke pagina wordt gescheiden door een markering --- Page N ---, zodat je ziet waar de ene pagina eindigt en de volgende begint. De tekst wordt opgehaald in de volgorde waarin die in de PDF is opgeslagen. De meeste documenten lezen natuurlijk; enkele met ongebruikelijke indelingen met meerdere kolommen kunnen de kolommen door elkaar zetten, omdat de tool de opgeslagen volgorde van de PDF volgt in plaats van een leesroute te raden.

Veelvoorkomend gebruik

  • Een AI-model voeden. Taalmodellen nemen platte tekst, geen PDF's. Eerst extraheren houdt alles snel en voorspelbaar.
  • Citeren en zoeken. Kopieer een passage zonder te vechten met de selectie van de PDF-viewer.
  • Inhoud hergebruiken. Verplaats tekst naar een document, een e-mail of een notitie zonder het opnieuw te typen.

Veelgestelde vragen

Nee. Het leest de ingebedde tekstlaag, en een scan is gewoon een afbeelding zonder tekstlaag, dus die komt er leeg uit. Gebruik een OCR-tool voor gescande of gefotografeerde documenten en haal daarna de tekst eruit.

Nee. Het extraheren gebeurt volledig in je browser, op je eigen apparaat. De PDF wordt nooit naar een server gestuurd en er wordt niets opgeslagen.

Enkele PDF’s, vooral indelingen met meerdere kolommen, slaan hun tekst op in een andere volgorde dan je die leest. De tool volgt de opgeslagen volgorde van de PDF, dus kolommen kunnen door elkaar lopen. Documenten die uit tekstverwerkers zijn geëxporteerd komen er bijna altijd correct uit.

Niet zolang ze vergrendeld zijn. Verwijder eerst het wachtwoord met een tool om PDF’s te ontgrendelen en haal daarna de tekst eruit.

Gerelateerde tools

Tool beschikbaar in andere talen