Pdf-samenvatter
Stap 1 van 3
Deze samenvattingssessie is niet meer beschikbaar
Kies een pdf met tekst
Gebruik één pdf van maximaal 20 MiB en 150 pagina’s. De tool leest de tekstlaag; gescande pagina’s hebben OCR nodig.
of zet hier één pdf neer
Laden...
Grote documenten kunnen even duren. Je kunt veilig stoppen zonder een gedeeltelijk resultaat te bewaren.
pagina’s
Wil je eerst snel door een rapport, onderzoek of briefing gaan? Deze pdf-samenvatter leest de tekstlaag die al in het bestand zit en rangschikt zinnen op terugkerende woorden. Daarna toont hij de gekozen zinnen in hun uitgelezen volgorde en maximaal 12 veelvoorkomende termen. De tool gebruikt geen AI, herschrijft niets, controleert geen feiten en vervangt aandachtig lezen niet. De pdf en de uitgelezen tekst blijven in de browser.
Zo vat je een pdf samen
-
1
Kies een pdf met tekst
Selecteer één echt pdf-bestand van maximaal 20 MiB en 150 pagina’s. Een scan die alleen uit afbeeldingen bestaat, heeft eerst OCR nodig.
-
2
Lees de tekst uit in de browser
De tool leest de ingebedde tekstlaag lokaal en stopt boven 2.000.000 uitgelezen tekens. Beveiligde, beschadigde en onleesbare bestanden worden geweigerd.
-
3
Stel de lengte in
Vraag 3 tot 20 zinnen. Bevat een kort document minder zinnen, dan verschijnen alle beschikbare zinnen zonder extra tekst te verzinnen.
-
4
Controleer en kopieer
Vergelijk de gekozen zinnen en frequente termen met de oorspronkelijke pdf en kopieer daarna de samenvatting naar je notities.
Wat een extractieve pdf-samenvatting laat zien
Een extractieve samenvatting neemt zinnen uit de bron over in plaats van nieuwe tekst te schrijven. De tool telt betekenisvolle woorden, geeft zinnen aan het begin een kleine bonus, kiest het gevraagde aantal hoog scorende zinnen en zet ze daarna terug in de uitgelezen volgorde.
Een eenvoudig voorbeeld
Stel dat een projectnotitie vier zinnen bevat:
- De proef verkortte de gemiddelde wachttijd bij de helpdesk.
- Het team vernieuwde ook het opleidingshandboek.
- Na de tweede invoering daalde de wachttijd opnieuw.
- Het rapport adviseert de wachttijd maandelijks te volgen.
Omdat wachttijd terugkomt, kunnen zinnen 1, 3 en 4 hoger scoren dan zin 2. Bij een instelling van drie zinnen blijft de volgorde 1, 3, 4 behouden. De tool schrijft geen nieuwe conclusie en bepaalt niet of het rapport klopt.
Wat de browser doet
| Fase | Werkelijk gedrag |
|---|---|
| Pdf lezen | Laadt de ingebedde tekstlaag met PDF.js; voert geen OCR uit |
| Zinsgrenzen | Gebruikt waar mogelijk Intl.Segmenter voor de paginataal, anders Unicode-leestekens |
| Woordgrenzen | Gebruikt taalbewuste woordsegmentatie en filtert een korte lokale lijst met stopwoorden |
| Rangschikking | Scoort terugkerende woorden en geeft vroege zinnen een bescheiden bonus |
| Uitvoer | Behoudt de uitgelezen volgorde en toont maximaal 12 frequente termen |
Belangrijke beperkingen
- De tekstlaag bepaalt het resultaat. Kolommen, tabellen, kop- en voetteksten en bijzondere lettercoderingen kunnen in een andere volgorde worden uitgelezen dan je op de pagina ziet.
- De paginataal stuurt de segmentatie. De tool onderzoekt niet het hele document om de taal vast te stellen. Wijkt de documenttaal af, dan kunnen zinnen en woorden minder goed worden verdeeld.
- Selectie kan context weglaten. Een letterlijk overgenomen zin kan zonder de omliggende alinea, tabel of voorwaarde misleidend zijn.
- Geen feitencontrole. De tool rangschikt herhaling, maar beoordeelt geen bewijs, tegenspraak of juistheid.
- Vaste grenzen. De maxima zijn 20 MiB, 150 pagina’s en 2.000.000 uitgelezen tekens.
Privacy in de drietrapsstroom
De bron-pdf en de uitgelezen tekst blijven in browseropslag. De stroom verwijst met een ondoorzichtige code in de URL naar dat lokale record en laat het na 30 minuten verlopen. De pagina en pdf-bibliotheek downloaden wel hun normale onderdelen, maar sturen je pdf daarin niet mee. Het bestand gaat niet naar onze servers of naar een conversiedienst.
Veelgestelde vragen
Nee. Een vaste woordfrequentiescore kiest zinnen uit de uitgelezen tekst. Er wordt geen taalmodel aangeroepen, niets geparafraseerd, geen nieuwe bewering gemaakt en geen feit gecontroleerd.
Niet zelfstandig. Een scan met alleen pagina-afbeeldingen heeft geen ingebedde tekstlaag. Voer eerst OCR uit en gebruik daarna de doorzoekbare pdf.
Een pdf bewaart gepositioneerde tekst in plaats van gewone alinea’s. Kolommen, tabellen, herhaalde kopteksten, voetteksten en bepaalde lettertypen kunnen de extractievolgorde veranderen. De tool behoudt die volgorde, die niet altijd gelijk is aan de visuele leesvolgorde.
De browser verdeelt zinnen en woorden volgens de huidige paginataal, ook bij talen zonder spaties tussen alle woorden. Er is een Unicode-reserveregel, maar de taal van de pdf wordt niet automatisch herkend. De site- en documenttaal laten overeenkomen geeft de beste grenzen.
Gebruik één echte pdf van maximaal 20 MiB, 150 pagina’s en 2.000.000 uitgelezen tekens. Pdf’s met een wachtwoord, beschadigde en onleesbare bestanden worden geweigerd.
Nee. De pdf en uitgelezen tekst blijven in de browser. In de drietrapsstroom blijft het privérecord maximaal 30 minuten bestaan en bevat de URL alleen de ondoorzichtige code. Normale pagina- en bibliotheekonderdelen worden zonder je bestand gedownload.
Gerelateerde tools
PDF naar Excel converter
Detecteer regelmatige tabellen in een tekst-PDF en download lokale XLSX-, CSV- of TSV-bestanden. Controleer elke tabel. Limiet: 20 MiB en 150 pagina's.
Word naar PDF
Converteer Word-documenten in .doc en .docx naar PDF met behoud van pagina-indeling, afbeeldingen, tabellen en koppen. Veilige upload, automatische verwijdering na 2 uur.
PDF naar Word converter
Zet PDF-bestanden om naar volledig bewerkbare Word-documenten. Koppen, lijsten, afbeeldingen en tabellen blijven behouden. Gescande PDF’s worden automatisch met OCR verwerkt.
PDF bewerken
Voeg tekst, markeringen, rechthoeken en witte vlakken toe aan een PDF in de browser. Exporteer een nieuw PDF-bestand zonder software te installeren.
PDF splitsen
Splits een PDF in één bestand per pagina of in aangepaste bereiken zoals 1-3, 4-6, 8. Verwerk in je browser en download een ZIP.
PDF vergelijken
Vergelijk uitleesbare tekst uit twee PDF’s per pagina. Markeer wijzigingen lokaal in de browser, zonder bestanden te uploaden.