Təkrarlanan sətirləri silən

2 reytinqdən 5

Təkrarlanan sətirləri silən pulsuz alətdir. Daxil etdiyin mətndə təkrarlanan sətirləri silir və neçə sətir qaldığını göstərir.

Təkrarlanan sətirləri necə silim?

Hər sətirdə bir element olmaqla mətni daxil et, aləti işə sal, sonra təmizlənmiş nəticəni köçür.

  1. Mənbə mətni elə hazırla ki, hər e-poçt ünvanı, URL, məhsul kodu və ya digər dəyər ayrıca sətirdə olsun.
  2. Təkrarlananları silmək üçün mətni göndər.
  3. Nəticəni başqa yerdə istifadə etməzdən əvvəl göstərilən sayları və təmizlənmiş sətirləri yoxla.

Alət PHP-nin array_unique əməliyyatından istifadə edir. Eyni sətir bir neçə dəfə təkrarlanırsa, onun ilk nüsxəsi saxlanılır, sonrakı eyni nüsxələr isə silinir.

Təkrarlanan sətirlərin silinməsi nə vaxt vaxta qənaət edir?

Siyahıda ixrac, köçürmə və ya bir neçə mənbənin birləşdirilməsi nəticəsində təkrarlanan qeydlər yarandıqda bu əməliyyat vaxta qənaət edir.

  • Excel və Google Sheets ixraclarında: iş vərəqləri birləşdirildikdən sonra eyni e-poçt ünvanları, istinad nömrələri və ya stok kodları tez-tez təkrarlanır.
  • Mailchimp idxal fayllarında: faylı yükləməzdən əvvəl təkrarlanan e-poçt sətirlərini silmək lazım gələ bilər. Lakin sətirlərin silinməsi ünvanların düzgünlüyünü yoxlamır və ayrı-ayrı əlaqə qeydlərini uzlaşdırmır.
  • Shopify məhsulları ilə işləyərkən: dəyərlər birdən çox hesabatdan köçürüldükdə eyni SKU-lar təkrarlana bilər.
  • Google Search Console ixraclarında: məlumatları sətir-sətir URL siyahısında birləşdirib sonrakı təhlildən əvvəl təmizləmək mümkündür.
  • GitHub konfiqurasiya fayllarında: sadə icazə və istisna siyahıları da daxil olmaqla, müxtəlif iştirakçıların əlavə etdiyi eyni qeydlər ola bilər.

Mənbənin dəyişdirilməmiş nüsxəsini saxlamaq faydalıdır. Beləliklə, təkrarlanan kimi silinmiş istənilən sətri bərpa edə bilərsən. Təkrar olduğu görünən sətir silinməyibsə, onu sətir sonundakı boşluqları və digər görünməyən simvolları göstərə bilən sadə mətn redaktorunda yoxla.

Boşluqlar, böyük hərflər və durğu işarələri necə nəzərə alınır?

Alət sətirlərin tam dəyərini müqayisə edir. Buna görə sətir daxilindəki fərqlər iki qeydin eyni sayılmasına mane ola bilər.

Məsələn, "Manchester", "manchester" və "Manchester " ayrı-ayrı sətir dəyərləridir, çünki böyük-kiçik hərf istifadəsi və ya sondakı boşluq fərqlənir. Rəqəmlər və durğu işarələri də müqayisəyə daxildir. Buna görə "INV-104" ilə "INV104" eyni sayılmır. Alət fərqli formatda yazılmış iki dəyərin eyni müştəriyə, URL-ə və ya məhsula aid olduğunu müəyyən etmir.

Diakritik işarəli və latın əlifbasından kənar mətnlər sətir dəyərləri kimi saxlanıla bilər. Lakin vizual olaraq eyni görünən Unicode mətnlərinin əsasında fərqli simvol ardıcıllıqları dayana bilər. Mətn əvvəlcədən normallaşdırılmayıbsa, belə sətirlər ayrı qala bilər. Boş sətirlər array_unique əməliyyatına təkrarlanan boş dəyərlər kimi çatarsa, yalnız ilk boş dəyər saxlanılır.

Çox böyük fayllardakı bütün sətirlərin təkrarlarını silmək üçün məlumatı brauzer alətinə daxil etməkdənsə, elektron cədvəl əmri və ya skript daha praktik ola bilər.

Nəticəni necə oxuyum?

Nəticə sahələrində ilkin sətir sayı, qalan sətirlərin sayı və silinən sətirlərin sayı göstərilir.

  • Sətirlər: göndərilən siyahıdakı sətirlərin sayıdır.
  • Yeni sətirlər: təkrarlanan dəyərlər silindikdən sonra qalan sətirlərin sayıdır.
  • Silinən sətirlər: neçə təkrarlanan dəyərin silindiyini göstərir.

Silinən sətirlərin sayını gözlədiyin nəticə ilə müqayisə et. Say gözlənilmədən azdırsa, sətirlər çox vaxt boşluq, böyük-kiçik hərf istifadəsi və ya durğu işarələrinə görə fərqlənir. Say gözlənilmədən çoxdursa, ilkin məlumatda təkrarlanan sətirlərin ayrıca məna daşıması mümkündür. Məsələn, bunlar təsviri eyni olan fərqli əməliyyatlar ola bilər.

Sətirlərlə praktiki nümunələr

Giriş sətirləri "pear", "apple" və "pear" olduqda nəticədə "pear" və "apple" qalır. "pear" dəyərinin ikinci nüsxəsi silinir, ilk nüsxələrin sırası isə qorunur.

"London", "london" və sonunda boşluq olan "London " birbaşa sətir müqayisəsində üç fərqli dəyər sayılır. Böyük-kiçik hərf istifadəsinin və kənar boşluqların əvvəlcədən təmizlənməsi ayrıca əməliyyatdır.

Dəyərlər sətir keçidləri ilə deyil, vergüllərlə ayrılıbsa, əvvəlcə Mətn ayırıcı vasitəsilə hər dəyəri ayrıca sətirə yerləşdir. Təkrarlananların silinməsi sətirlər üzrə aparılır, sətir daxilindəki ayrı-ayrı sözlərə və ya vergüllə ayrılmış sahələrə tətbiq edilmir.

Tez-tez verilən suallar

CSV faylındakı təkrarları silə bilərəm?

CSV məzmununu daxil edə bilərsən, lakin alət bütöv sətirləri müqayisə edir. Qonşu sütunlardakı fərqli məlumatları qoruyaraq yalnız bir sütundakı təkrarları silmir. Sütun üzrə müqayisə üçün Excel-in Remove Duplicates əmrindən, Google Sheets-dən və ya CSV strukturunu nəzərə alan skriptdən istifadə et.

Nömrələnmiş siyahı elementləri niyə təkrar sayılmır?

Sətrin əvvəlindəki nömrələr də onun bir hissəsidir. Buna görə "1. Bristol" və "2. Bristol" fərqli dəyərlərdir. Müqayisə edilməli dəyər yer adıdırsa, təkrarları silməzdən əvvəl nömrələməni götür.

Məxfi məlumatları daxil etmək təhlükəsizdirmi?

Emal serverdə aparılır. Daxil etdiyin məlumat HTTPS üzərindən serverə göndərilir və saxlanılmır, lakin emal zamanı cihazını tərk edir. Təşkilatının qaydaları məxfi və ya tənzimlənən məlumatların xarici xidmətə göndərilməsini qadağan edirsə, belə məlumatları daxil etmə.

JSON və ya proqram kodunu təmizləmək üçün bu alətdən istifadə edə bilərəm?

Təkrarlanan sətirləri fərq qoymadan silmək JSON-u, mənbə kodunu və təkrarlanan mətnin məqsədli ola biləcəyi digər strukturlaşdırılmış formatları poza bilər. Struktur və sətrin mövqeyi mənaya təsir edirsə, parserdən, formatlayıcıdan və ya konkret proqramlaşdırma dili üçün nəzərdə tutulmuş alətdən istifadə et.

Son yoxlamalar

Təmizlənmiş siyahını idxal etməzdən əvvəl yoxla, xüsusən də təkrarlanan sətirlər ayrı-ayrı sifarişləri, ödənişləri və ya hadisələri ifadə edə bilərsə. Təyinat sistemi yenilənmiş məlumatları qəbul edənədək və alətin saxladığı və sildiyi sətirləri yoxlayanadək orijinal faylı saxla.

Populyar alətlər