Word-naar-Markdown-converter

Zet een modern Word-document (.docx) om naar nette, bewerkbare Markdown zonder het te uploaden. De browser leest de documentstructuur en behoudt ondersteunde koppen, alinea’s, vet en cursief, links, lijsten, citaten, codeopmaak en eenvoudige tabellen. Controleer de veilige voorvertoning, kopieer het resultaat of download een .md-bestand. Afbeeldingen worden vervangen door een duidelijke melding; paginaopmaak en andere Word-specifieke functies worden eerlijk als beperkingen vermeld.

Een Word-document naar Markdown converteren

  1. 1

    Kies een DOCX

    Open een niet-versleuteld `.docx`-bestand. De converter controleert lokaal de ZIP- en Office Open XML-structuur.

  2. 2

    Kies Markdown-markeringen

    Kies koppen met hekjes of onderstreping en een streepje of sterretje voor opsommingen.

  3. 3

    Controleer de structuur

    Bekijk de veilige voorvertoning en meldingen over weggelaten afbeeldingen of Word-functies die niet goed in Markdown passen.

  4. 4

    Kopieer of download

    Kopieer de Markdown of bewaar die als UTF-8-`.md`-bestand met een naam die van het DOCX-bestand is afgeleid.

Van WordprocessingML naar Markdown

Een DOCX is een Office Open XML-pakket, geen enkele stroom opgemaakte tekst. Microsoft beschrijft een eenvoudig tekstverwerkingspakket als een verzameling onderdelen, waaronder een hoofdonderdeel met de documentinhoud. Deze converter controleert eerst de verwachte pakketstructuur en gebruikt daarna Mammoth.js om tussentijdse semantische HTML te maken. Mammoth kiest bewust voor semantische structuur in plaats van een exacte kopie van de Word-weergave, precies de juiste grens voor Markdown.

De tussentijdse HTML wordt in het geheugen ontleed en omgezet naar blokken en inline-elementen volgens CommonMark. Eenvoudige tabellen gebruiken de tabelextensie van GitHub Flavored Markdown. De ruwe HTML wordt nooit rechtstreeks ingevoegd. De voorvertoning wordt uit de Markdown gemaakt en vóór weergave opgeschoond.

Word-structuur Markdown-resultaat Grens van de conversie
Kopstijlen Koppen met # of Setext-koppen van niveau 1 en 2 Alleen een groter lettertype maakt tekst nog geen kop
Alinea’s, vet, cursief, doorgehaald Alinea’s en inline-markeringen Lettertypen, kleuren en exacte afstanden vervallen
Genummerde lijsten en opsommingen Genummerde en ingesprongen lijstitems Ingewikkelde aangepaste nummering moet mogelijk worden bijgewerkt
Hyperlinks [label](URL) Alleen veilige web-, e-mail- en fragmentlinks blijven behouden
Eenvoudige tabellen GFM-tabel met verticale strepen Samengevoegde cellen en complexe indelingen worden vereenvoudigd
Afbeeldingen en ingesloten objecten Zichtbare weglatingsmelding Binaire media worden niet naar Markdown geëxporteerd

Praktijkvoorbeeld

Stel dat een DOCX een kop Projectstatus van niveau 1, twee alinea’s, een genummerd stappenplan met drie stappen en een tabel van 2 × 3 met een verantwoordelijke en deadline bevat. Met hekjeskoppen begint het resultaat met # Projectstatus, gevolgd door gewone alinea’s, 1.-lijstmarkeringen en een GFM-tabel waarvan de eerste rij de kopregel wordt. Een zwevende grafiek in hetzelfde document wordt niet geconverteerd. De tool toont een beperking, zodat het ontbrekende object niet wordt aangezien voor een geslaagde export.

Wat Markdown niet kan behouden

Markdown beschrijft inhoudsstructuur, niet de pagina-indeling van Word. Pagina’s, kolommen, marges, kop- en voetteksten, lettertypen, kleuren, zwevende posities, tekstvakken, grafieken, SmartArt, vergelijkingen, macro’s, OLE-objecten, formulieren, opmerkingen en revisiegeschiedenis vallen buiten het resultaat. Complexe tabellen met samengevoegde cellen kunnen hun raster verliezen. Controleer technische of gereguleerde documenten zorgvuldig en bewaar het oorspronkelijke DOCX als gezaghebbende bron.

Bestands- en privacygrenzen

De converter accepteert .docx, niet het oude .doc, .docm, ODT of PDF. Pakketten zonder de verwachte Office Open XML-onderdelen, versleutelde ZIP-items, meer dan 2.000 pakketitems, meer dan 25 MiB gecomprimeerd of 80 MiB uitgepakt worden geweigerd. Deze grenzen beperken geheugenrisico’s, maar herstellen geen beschadigde bestanden.

De DOCX-bytes, bestandsnaam, uitgepakte structuur, instellingen, voorvertoning en Markdown blijven in deze browser. In de meerstappenflow verwijst een willekeurig token in het sessionStorage van dit tabblad maximaal twee uur naar een vervallend IndexedDB-record. De inhoud komt nooit in de URL en wordt niet via Livewire verzonden. Opnieuw beginnen verwijdert het token en het opgeslagen record.

Veelgestelde vragen

Gebruik een modern, niet-versleuteld .docx-bestand. Oude .doc-bestanden, .docm met macro’s, ODT, PDF, versleutelde pakketten, beschadigde bestanden en bestanden boven de genoemde grenzen worden geweigerd. Sla een ouder Word-document eerst op als DOCX.

De converter verwerkt semantische koppen, alinea’s, vet, cursief, doorhalen, veilige links, regeleinden, genummerde lijsten en opsommingen, citaten, codestijlen die Word herkenbaar maakt en eenvoudige GFM-tabellen. Alleen visuele opmaak zonder semantische structuur wordt mogelijk niet goed overgezet.

Afbeeldingen krijgen een zichtbare weglatingsmelding en waarschuwing. Paginaopmaak, kolommen, kop- en voetteksten, lettertypen, kleuren, zwevende items, samengevoegde tabellen, grafieken, SmartArt, vergelijkingen, macro’s, ingesloten objecten, formulieren, opmerkingen en revisiegeschiedenis worden niet exact overgenomen.

Word is een systeem voor paginaopmaak, terwijl Markdown een lichte documentstructuur beschrijft. De converter behoudt ondersteunde betekenis, niet pixelposities, pagina-einden, lettertypen of exacte afstanden. Controleer en bewerk het resultaat vóór publicatie.

Nee. Bestandsbytes, naam, inhoud, instellingen, voorvertoning en Markdown blijven in uw browser en worden niet via Livewire verzonden of in de URL geplaatst. Flowherstel gebruikt alleen in dit tabblad een vervallend record; Opnieuw beginnen verwijdert dit.

Gerelateerde tools