Sortowanie i usuwanie duplikatów
Sortuj wiersze alfabetycznie lub naturalnie, usuwaj duplikaty i puste
O tym narzędziu
Warsztat do obróbki wierszy: wklej dowolną listę i posortuj ją alfabetycznie, odwrotnie, naturalnie (item2 przed item10), według długości albo ją przetasuj — opcjonalnie przycinając białe znaki, usuwając puste wiersze i kasując duplikaty z zachowaniem kolejności. Liczba usuniętych wierszy jest raportowana, więc dokładnie widzisz, co zrobiło odsiewanie duplikatów.
Sortowanie naturalne to opcja, po którą sięgniesz najczęściej: zwykłe sortowanie alfabetyczne stawia „item10” przed „item2”, bo porównuje znak po znaku, a sortowanie naturalne porównuje osadzone liczby liczbowo — czyli w kolejności, jakiej ludzie oczekują dla nazw plików, wersji i identyfikatorów.
Odsiewanie duplikatów zachowuje pierwsze wystąpienie i pierwotną kolejność tych, które zostały, co ma znaczenie, gdy kolejność listy coś znaczy (importy, wiersze konfiguracji, playlisty). Tryb ignorujący wielkość liter traktuje „Apple” i „apple” jako ten sam wiersz.
Często zadawane pytania
- Czym różni się sortowanie alfabetyczne od naturalnego?
- Alfabetyczne porównuje kody znaków, więc „file10” < „file2” (bo na piątej pozycji „1” < „2”). Sortowanie naturalne rozpoznaje ciągi cyfr i porównuje je jako liczby, dając file2 < file10. Do wszystkiego, co zawiera liczby, używaj naturalnego.
- Czy odsiewanie duplikatów zostawia pierwsze czy ostatnie wystąpienie?
- Pierwsze. Wiersze przeglądane są z góry na dół, a wiersz zostaje usunięty tylko wtedy, gdy identyczny (lub równy z pominięciem wielkości liter, w odpowiednim trybie) pojawił się wcześniej — dzięki temu kolejność ocalałych odpowiada oryginalnej.
- Jak dużą listę to udźwignie?
- Setki tysięcy wierszy nie stanowią problemu — operacje to proste przebiegi plus jedno sortowanie. Wszystko zostaje w pamięci przeglądarki, więc praktyczną granicą jest Twoja maszyna, a nie limit serwera.
- Czy mogę łączyć operacje?
- Tak, i stosowane są w sensownej kolejności: najpierw przycinanie, potem usuwanie pustych, potem duplikatów, na końcu sortowanie — dzięki czemu przy włączonym przycinaniu „ apple ” i „apple” odsiewają się razem, a sortowanie zawsze widzi już oczyszczoną listę.