CSV-kolomextractor

Kolommen extraheren

Een export uit uw CRM-, analytische platform of database bevat vaak 30 kolommen, terwijl u slechts 3 nodig hebt. Dit hulpmiddel leest een CSV-bestand, haalt een door komma’s gescheiden lijst met kolomindexen (vanaf 1) en genereert een nieuw CSV-bestand met alleen deze kolommen, in de door u gevraagde volgorde. Kop rijen en gegevensrijen worden op dezelfde manier behandeld: kolom 1 in de kop staat altijd op positie 1 in elke gegevensrij.

Hoe extraheren van kolommen

  1. 1

    Plak de CSV

    Het volledige bestand of een fragment. De regels worden gescheiden door CR-, LF- of CRLF-tekenen en elke regel wordt verwerkt volgens standaard CSV-regels.

  2. 2

    Lijst de kolommen die moeten worden behouden

    Gebruik indexen met als basisnummer 1, gescheiden door komma's, bijvoorbeeld `1,3,5`. De uitvoer volgt deze volgorde; u kunt de kolommen op het moment van gebruik herordenen.

  3. 3

    De uitvoer uitvoeren

    Elke rij wordt opnieuw geschreven met alleen de gevraagde cellen. Komma's binnen cellen worden automatisch tussen aanhalingstekens geplaatst.

  4. 4

    Kopieer of slaan op

    Plak het resultaat in Excel, een database-importassistent of elk ander hulpmiddel dat CSV-bestanden kan lezen.

Hoe de extractor omgaat met de lastige aspecten

Een CSV-bestand ziet er eenvoudig uit, totdat u een cel tegenkomt met een komma of aanhalingsteken erin. De extractor ontleedt elke regel volgens CSV-regels in RFC 4180-stijl.

Regels voor het ontleden van invoer

  • De rijen worden gesplitst op elke Unicode-regeleinde, waardoor bestanden van Windows, macOS en Linux allemaal werken.
  • Cellen tussen aanhalingstekens kunnen komma’s, nieuwe regels en ge-escapete aanhalingstekens bevatten ("").
  • Lege eindrijen worden verwijderd.

Uitvoeropmaak

  • De kolomvolgorde in de uitvoer komt overeen met de volgorde die u typt, niet met de volgorde in de invoer.
  • Een cel die een komma bevat, wordt opnieuw tussen dubbele aanhalingstekens geplaatst, zodat parsers verderop deze correct teruglezen.
  • Cellen zonder komma’s worden ongewijzigd uitgevoerd om de uitvoer compact te houden.

Valkuilen om op te letten

Scenario Wat gebeurt er
Index voorbij de laatste kolom Op die positie wordt een lege tekenreeks uitgevoerd.
Negatieve of nul-index Indexen kleiner dan 1 worden genegeerd.
Cel bevat een aanhalingsteken Wordt in de uitvoer opnieuw tussen aanhalingstekens gezet volgens RFC 4180 (""), zodat strikte parsers deze correct teruglezen.
Dubbele index, bijvoorbeeld 1,1,2 Kolom 1 wordt twee keer uitgevoerd, handig voor het dupliceren van sleutels in spreadsheets.

Voor zeer grote bestanden (miljoenen rijen) wordt aanbevolen om het CSV-bestand te streamen via een geschikte bibliotheek; de tool houdt alle gegevens in het geheugen en wordt trager voorbij een paar honderdduizend rijen.

Veelgestelde vragen

Indexen, beginnend bij 1 voor de linkste kolom. Om gegevens op te halen op basis van de kopnaam, selecteer de kopregel in uw CSV-bestand en vertaal de namen naar de corresponderende posities.

Ja. De uitvoer behoudt de volgorde van uw indexlijst. Voor elke rij, inclusief de kop, wordt kolom 3 eerst weergegeven, gevolgd door kolom 1 en vervolgens kolom 2 voor 3,1,2.

Missende cellen worden gevuld met een lege string. Dit zorgt ervoor dat de uitvoer rechthoekig blijft, zodat downstream-tools niet op oneffen rijen falen.

Ja. Om de kolommen te extraheren wordt de CSV naar onze server gestuurd, verwerkt en wordt het resultaat teruggezonden naar uw browser. Het wordt niet opgeslagen en niet aan de paginalink toegevoegd.

Gerelateerde tools

Tool beschikbaar in andere talen