Hvad er Fjern dubletlinjer?
Gratis online værktøj til hurtigt at fjerne dubletlinjer fra tekst med valgmulighed for at bevare tomme linjer.
Duplike linjer i tekstdata forårsager unøjagtige tællinger, opsvulmede filstørrelser og upålidelig analyse. Remove Duplicate Lines leverer tre driftstilstande — fjern duplikater, behold kun unikke linjer eller find duplikater — med muligheder for bogstavfølsomhed og trimning til at håndtere virkelighedens tekstvariationer.
I Remove Duplicates-tilstand scanner værktøjet inputteksten og beholder kun den første forekomst af hver linje og sletter efterfølgende duplikater. Den oprindelige linjeordre bevares. Det er den mest almindeligt anvendte tilstand til at rydde op i importerede data, flette lister eller fjerne duplikerede e-mailadresser. Keep Unique-tilstanden går et skridt videre ved at fjerne alle linjer, der optræder mere end én gang, og kun beholde linjer, der optræder præcis én gang. Det er nyttigt til at finde poster, der er unikke i et datasæt — for eksempel til at identificere, hvilke e-mailadresser i en liste der tilhører kun én person.
Find Duplicates-tilstanden gør det modsatte: den viser kun linjer, der optræder mere end én gang, og ignorerer linjer, der kun optræder én gang. Det er nyttigt til at undersøge datakvalitetsproblemer eller identificere gentagne poster, der kan kræve opmærksomhed. Hver tilstand viser statistikker med antallet af inputlinjer, outputlinjer og fjernede linjer.
Kontakten for bogstavfølsomhed styrer, om "Hello" og "hello" behandles som den samme linje eller som forskellige linjer. Trim-muligheden fjerner foranstillede og efterstillede mellemrum fra hver linje før sammenligning, hvilket forhindrer falske duplikater forårsaget af inkonsistent afstand — et almindeligt problem, når du indsætter data fra forskellige kilder. Al behandling sker lokalt og øjeblikkeligt.