CanDoYa
CS

Odstranění duplicitních řádků

Běží celé ve vašem prohlížeči - nic se nenahrává, žádná registrace.

Vstupní text
Text bez duplicit
Vlož řádky pro odstranění duplicit - první výskyt každého řádku zůstane zachován
Sdílet tento nástroj

Jak odstranit duplicitní řádky z textu?

Vlož text do pole nahoře a každý opakující se řádek okamžitě zmizí - zachová se první výskyt každého řádku, v původním pořadí. Zapni Ignorovat velikost písmen nebo Oříznout mezery, aby se zachytily téměř duplicitní řádky jako „Praha” a „praha”, a pak zkopíruj vyčištěný seznam. Nic se nikam neodesílá - odstranění duplicit probíhá celé v prohlížeči.

Jak na to

  1. 1Vlož své řádky. Napiš nebo vlož jakýkoli víceřádkový text do levého pole - jedna položka na řádek. Fungují konce řádků z Windows, Macu i Unixu.
  2. 2Vyber, jak se řádky porovnávají. Ve výchozím nastavení musí řádky souhlasit přesně. Zapni Ignorovat velikost písmen, aby se „Praha” a „praha” počítaly jako duplicity, Oříznout mezery, aby se ignorovaly mezery na začátku a konci, nebo Odstranit prázdné řádky, aby zmizely prázdné řádky.
  3. 3Zkopíruj vyčištěný seznam. Text bez duplicit se zobrazuje živě vpravo a stavový řádek ukazuje, kolik duplicit bylo odstraněno. Klikni na Kopírovat a přenes výsledek do schránky.

Pro koho je nástroj

Nástroj odstraňuje duplicity za psaní a nikdy neupravuje vstupní pole, takže lze přepínat volby a porovnávat výsledky bez ztráty originálu. Ve výchozím nastavení musí dva řádky souhlasit přesně, znak po znaku. Ignorovat velikost písmen bere Praha a praha jako stejný řádek; Oříznout mezery ignoruje mezery a tabulátory na začátku a konci, což zachytí neviditelné duplicity, které rády vytvářejí tabulky a logovací soubory. Prázdné řádky se berou jako struktura, ne jako data - nikdy se nesloučí do jednoho, dokud nezapneš Odstranit prázdné řádky. Protože vše běží na straně prohlížeče, je bezpečné použít nástroj i pro e-mailové seznamy, exporty zákazníků nebo nezveřejněný výzkum klíčových slov.

Časté dotazy

Odesílá se můj text někam?

Ne. Odstranění duplicit probíhá celé v prohlížeči pomocí JavaScriptu - řádky se nikdy nedostanou na server. Díky tomu je nástroj bezpečný pro e-mailové seznamy, zákaznická data, soubory s hesly a cokoliv dalšího, co bys nevložil do náhodného formuláře na internetu.

Je tento nástroj na odstranění duplicitních řádků zdarma?

Ano - úplně zdarma, bez registrace, bez stahování a bez limitů použití. Jde o statickou stránku, takže se rychle načítá a funguje i na pomalejším připojení, jakmile se jednou otevře.

Existuje limit, kolik řádků lze vložit?

Žádný pevný limit neexistuje. Odstranění duplicit používá hashovací tabulku, takže i seznamy se stovkami tisíc řádků se zpracují na běžném notebooku za necelou sekundu. Praktickým limitem je paměť prohlížeče, ne samotný nástroj.

Který duplicitní řádek zůstane - první, nebo poslední?

První. Nástroj prochází text odshora dolů, ponechá první výskyt každého řádku na místě a odstraní každé pozdější opakování, takže výsledné pořadí odpovídá přesně tomu, v jakém byl text vložen.

Odstraní duplicitní řádky bez řazení?

Ano - a přesně o to jde. Příkazy jako sort -u odstraňují duplicity tak, že text nejdřív seřadí, čímž se zamíchají seřazená data. Tento nástroj zachovává původní pořadí řádků a jen maže opakování.

Jak se zachází s prázdnými řádky?

Prázdné řádky se berou jako struktura, ne jako data, takže se dva prázdné řádky nikdy nesloučí do jednoho. Pokud chceš kompaktní seznam úplně bez prázdných řádků, zapni Odstranit prázdné řádky a každý prázdný nebo jen mezerami vyplněný řádek zmizí.

Zachytí i duplicity lišící se jen mezerami nebo velikostí písmen?

Ano. Zapni Oříznout mezery, aby se ignorovaly mezery a tabulátory na začátku a konci, a Ignorovat velikost písmen, aby se řádky porovnávaly bez ohledu na velká a malá písmena. Při zapnutí obou voleb se „ Praha” a „praha” počítají jako stejný řádek; zachovaná verze se vypíše přesně tak, jak byla vložena.

Funguje s konci řádků Windows (CRLF)?

Ano. Konce řádků Windows (\r\n), Unixu (\n) i starého Macu (\r) se při rozdělení textu rozpoznají a vyčištěný výstup používá standardní unixové znaky nového řádku, které při vložení přijme každý editor i tabulkový procesor.