Ta bort dubbletter av rader efter kolumn
Släpp CSV/TSV-rader vars värde i en vald kolumn redan har visats.
Ta bort dubbletter av rader efter kolumn
Hellinjededuplicering missar det verkliga problemet: två rader är sällan identiska, de delar bara samma e-post, ID eller SKU medan allt annat skiljer sig. Det här verktyget bedömer rader efter en kolumn som du väljer - samma nyckel som visas två gånger tar bort den senare raden, vilket behåller datamängden en rad per nyckel utan en kalkylbladsformel i sikte.
Klistra in CSV, TSV eller andra avgränsade rader; avgränsaren detekteras från den första dataraden (komma, semikolon, tabb eller rör) med en manuell åsidosättning för kantfall. Välj nyckelkolumnen efter dess 1-baserade nummer, tala om för verktyget om den första raden är en rubrik - rubriker bevaras och jämförs aldrig - och välj vilken förekomst som överlever. Behåll först är standard; keep last är det klassiska tricket för ändringsloggar och exporter där den senaste raden per nyckel sitter längst ner. Värden beskärs före jämförelse, och en växel för ignorera skiftläge sammanfogar JAN@example.com med jan@example.com.
Sammanställningen rapporterar borttagningarna och radräkningen på vardera sidan, så en inklistring som inte gjorde något - fel kolumn, fel avgränsare - är omedelbart synlig. Rader som är kortare än nyckelkolumnen räknas som att ha ett tomt värde där och deduplicerar sinsemellan.
En ärlig begränsning: uppdelningen är enkel, inte en fullständig CSV-analys, så ett citerat fält som innehåller själva avgränsaren kommer att förvirra kolumnantalet – kör sådana filer genom CSV-avgränsarens växlare först. Allt körs lokalt i din webbläsare; din data lämnar aldrig din enhet.