Afbeeldingen extraheren uit een PDF

upload PDF

Upload een PDF en herstel alle ingebouwde afbeeldingen in hun oorspronkelijke resolutie. De extractor doorzoekt de objectstructuur van de PDF, vindt de /XObject /Image-vermeldingen en exporteert ze allemaal als PNG, zonder schermafbeelding en zonder kwaliteitsverlies door de hele pagina te rasteren. Werkt goed met scans, rapporten met veel foto’s, productcatalogi en brochures.

Hoe je afbeeldingen uit een PDF haalt

  1. 1

    PDF uploaden

    Voeg één bestand toe; versleutelde PDF-bestanden moeten eerst worden ontgrendeld.

  2. 2

    Scan de objectboom

    De extractor somt elke afbeelding van het type XObject op alle pagina's op.

  3. 3

    De resultaten voorvertonen

    Elke afbeelding wordt weergegeven als een miniatuur met het paginanummer en de afmetingen.

  4. 4

    Download individueel of als ZIP-bestand

    Haal één enkel bestand op of exporteer alles in één archief met de naam `image-p1-1.png`.

Hoe afbeeldingen in een PDF worden weergegeven

Een PDF slaat afbeeldingen op als afzonderlijke bronnen (/XObject-streams) waarnaar vanuit de pagina-inhoud wordt verwezen. De extractor leest elke stream in zijn oorspronkelijke codering en reconstrueert het bestand dat de auteur heeft ingebouwd.

De formaten die u ziet

PDF-filter Wat u ontvangt Typische bron
/DCTDecode PNG (van een JPEG) Foto’s, productafbeeldingen, scans
/FlateDecode + RGB PNG Logo’s, grafieken en schermafbeeldingen van de gebruikersinterface
/JPXDecode PNG (van JPEG 2000) Archiefscans in hoge resolutie
/CCITTFaxDecode PNG (van een scan) Zwart-witgescande tekst
/JBIG2Decode PNG (geconverteerd) Gecomprimeerde gescande documenten

De extractor levert altijd PNG op: hij codeert de ruwe pixels opnieuw in uw browser, dus JPEG-, JPEG-2000- en CCITT-bronnen komen ook als PNG binnen.

Wat niet kan worden hersteld

  • Vectorillustraties: Logo’s die zijn getekend met PDF-padoperatoren zijn geen afbeeldingen; ze behoren tot de inhoudsstroom en niet tot de XObjects. Gebruik hiervoor een tool voor het omzetten van PDF naar SVG.
  • Achtergrondkleuren en verlopen: Dit is tekenwerk op paginaniveau, geen ingebouwde elementen.
  • Tekst weergegeven als contouren. Lijkt op ‘grafiek’, maar is geen afbeeldingsobject.

Tips bij het werken met de export

  • Controleer de afmetingen. Een miniatuur van 300x300 op de pagina kan in werkelijkheid een origineel van 3000x3000 zijn dat tijdens het renderen is verkleind. U krijgt de bronpixels, niet de weergavegrootte.
  • Houd u aan de licentie. Het kunnen extraheren van een afbeelding betekent niet dat u het recht hebt het opnieuw te gebruiken. Stockafbeeldingen in een PDF blijven stockafbeeldingen ook nadat ze zijn geëxtraheerd.
  • Gescande documenten: Als elke pagina een grote afbeelding met ingebouwde tekst oplevert, gaat het om een scan. Voer OCR uit op de geëxporteerde PNG-bestanden om de tekst terug te winnen.

Veelgestelde vragen

PDF-pagina’s kunnen een transformatiematrix toepassen op de manier waarop een afbeelding wordt weergegeven (omkeren, roteren of schuiven). De extractor retourneert de opgeslagen bitmap, de ruwe pixels. Als een uitgever de afbeelding omgekeerd heeft opgeslagen en deze tijdens het renderen weer omkeert, wordt de export omgekeerd weergegeven. Roteer de afbeelding vervolgens terug in een willekeurige beeldeditor.

Pas nadat u ze hebt ontgrendeld. Verwerk het bestand eerst met een PDF-ontgrendelingstool door het eigenaarswachtwoord in te voeren, en extraheer het daarna.

Ja. De afbeeldingen worden in paginaorde toegevoegd en elke bestandsnaam bevat het paginanummer, bijvoorbeeld image-p1-2.png, zodat u kunt zien van welke pagina elke afbeelding afkomstig is.

Nee. Het bronbestand PDF wordt volledig in uw browser geopend en gelezen en wordt nooit naar de server verzonden. Alleen het ZIP-bestand met de geëxtraheerde afbeeldingen wordt geüpload om het sessiebeveiligde resultaat te maken; het wordt tot 7 dagen bewaard en daarna verwijderd.

Gerelateerde tools

Tool beschikbaar in andere talen