Rekenaantal van regels

Plaats tekst, broncode, een logbestand of een CSV-bestand en de teller geeft het totale aantal regels terug, inclusief niet-lege regels, lege regels, unieke regels en dubbele regels. Handig wanneer een wervingsmedewerker vraagt ‘hoeveel locaties zijn er in deze repository?’, wanneer u wilt weten hoeveel rijen een CSV-bezit zonder deze in Excel te openen, of wanneer u een woordenlijst moet controleren op duplicaten voordat u die invoert in een script.

Hoe je rijen tellt

  1. 1

    Plak de inhoud

    Tot een aantal megabyte tekst, logbestand, bronbestand, Markdown, lijst.

  2. 2

    Lees de uitleg

    De totale, niet-lege, lege, unieke en duplicaatgetallen worden tegelijkertijd weergegeven.

  3. 3

    Bepaal wat wordt meegeteld.

    Commentaren, nieuwe regels aan het eind, lege ruimtes tussen secties, het is aan jouw gebruikscase om te bepalen hoe je het gebruikt.

  4. 4

    Handel op basis van de telling

    Bepaal de grootte van de import, verwijder dubbele records, knip het aantal af of rapporteer het als bewijs.

Wat wordt eigenlijk als een grens beschouwd?

Uiteenlopende tools geven voor dezelfde bestand verschillende ‘aantallen regels’ omdat ze op drie punten andere keuzes maken.

De drie onduidelijkheden

  1. Aanvullende nieuwe regel: POSIX-textbestanden eindigen met \n. Voegt de laatste nieuwe regel een extra lege regel toe? wc -l telt nieuwe regels mee: een bestand met inhoud op één regel en een aanvullende nieuwe regel geeft dus 1 terug; een bestand met inhoud zonder aanvullende nieuwe regel geeft 0 terug (wat verrassend is). Deze teller geeft het aantal ‘inhoudsregels’ weer en negeert de laatste lege regel na een terminator.

  2. Leeg versus alleen lege ruimte: Een regel met tussenruimtes of tabbaren maar zonder zichtbare tekens – is die leeg of niet? De teller beschouwt regels met alleen lege ruimte als leeg, net zoals de meeste editors doen.

  3. Enkelrechte bestanden: Een bestand met één regel zonder een nieuwe regel aan het eind telt nog steeds als één regel.

Uitleg van de uitgangswaarden van de teller

Metriek Definitie
Totaal aantal regels Alle regels, inclusief lege regels, tot de laatste niet-lege regel
Niet-leeg Regels met ten minste één niet-witruimte-teken
Leeg Regels die volledig leeg zijn of alleen uit witruimte bestaan
Uniek Verschillende, niet-lege regels; hoofdlettergevoelig
Duplicaten Niet-lege regels die meer dan één keer voorkomen (aantal duplicaten)

Veelgebruikte toepassingsgebieden

  • Wordlijst-deduplicatie: plak een woordlijst, controleer het aantal duplicaten en voer daarna een deduplicatietool uit.
  • Aantal rijen in CSV-bestand: plak het bestand en trek één rij af van de kop om het aantal gegevensrijen te bepalen.
  • Loganalyse: controleer of een geroteerde logbestand het verwachte aantal entries bevat.
  • LOC van bronbestand, snel bepalen hoeveel regels er in een bestand zitten, zonder een IDE te openen.
  • Hygiëne van de e-maillijst – controleer hoeveel adressen dubbel zijn voordat u een campagne verzendt.

LOC is geen productiviteit

Het aantal regels in de broncode is een onjuiste maatstaf. Een dichte, goed gefactoreerde module van 100 regels kan moeilijker te schrijven en te onderhouden zijn dan een uitgebreide module van 1.000 regels. Gebruik het aantal regels alleen voor schattingen van de omvang (of hoe goed de code past binnen een bepaald contextgebied, of voor het indelen van uitvoer op pagina’s of het vergelijken van bestandsgrote), en niet voor het beoordelen van de prestaties.

Unicode en regelafsluiters

De teller normaliseert \r\n, \r en \n tot één nieuwe regel voordat het wordt geteld, zodat regelafsluitingen van Windows, de klassieke Mac en Unix allemaal hetzelfde resultaat opleveren. Unicode-regelafbreekpunten (U+2028) en paragraafafbreekpunten (U+2029) worden eveneens als breuken behandeld.

Veelgestelde vragen

wc -l tellt nieuwe regeltekens; een bestand met inhoud maar zonder eindregel wordt daarom één keer minder geteld. Deze teller geeft het aantal regels met inhoud weer, wat overeenkomt met de statusbalken van de meeste editors.

Ja – regels die alleen bestaan uit ruimtes of tabbepjes worden als leeg beschouwd, niet als niet-leeg. Dit is in overeenstemming met VS Code, Sublime en de meeste Git-workflows.

Ja. ‘Hello’ en ‘hello’ worden als twee aparte, unieke regels gezien. Als u ongevoelig voor hoofd- en kleine letters wilt zijn bij het verwijderen van dubbele invoer, moet u de invoer eerst in kleine letters omzetten met een letteromzetter.

Nee – de counter leest de invoer lokaal en er wordt niets geüpload of geregistreerd.

Gerelateerde tools

Tool beschikbaar in andere talen