Pembanding Ekspor Crawl

Berjalan sepenuhnya di browser Anda—tidak ada yang Anda tempel yang diunggah atau disimpan. Both files stay in your browser. Files over 15 MiB and rows beyond the 100,000-row comparison cap are rejected or reported as truncated. Penghitung hasil anonim per proses dapat digunakan untuk riset agregat; URL, domain, IP, dan pengenal tidak pernah disertakan, dan statistik tidak dirilis jika jumlah proses kurang dari 100.

Masukan
Laporkan bug

Ada yang rusak di Pembanding Ekspor Crawl? Beri tahu kami apa yang terjadi—laporan ini langsung masuk ke antrean triase privat, bukan daftar publik.

Yang akan dikirim
 Input alat, unggahan, sumber yang ditempel, hasil lengkap, parameter kueri, dan fragmen URL tidak dilampirkan secara otomatis. Anda dapat mengedit atau menghapus kutipan yang dipilih di atas. Metadata browser dan antipenyalahgunaan diproses untuk mencegah spam. 

Tentang alat ini

Setelah rayapi

Ekspor halaman-tingkat CSV atau TSV berkas dari sebelum dan setelah crawls. Gunakan sebanding rayapi cakupan, robots, perenderan, authentication, dan batasan. Muat keduanya berkas dan tinjau detected vendor, dipetakan fields, diabaikan kolom, tidak valid URLs, duplicates, dan caps. Triage inventaris perubahan oleh jalur template, lalu periksa field perubahan per URL. Ekspor ternormalisasi perubahan daftar dan verifikasi penting regressions di sumber perayap atau pada langsung halaman.

Unduh perubahan CSV

Fitur

  • Keadaan URL Template Berubah bukti
  • 5 berubah URLs · 2 added · 2 dihapus · 1 field-berubah /products/:number — 1 added, 1 dihapus; verifikasi apakah produk IDs berubah atau rayapi scopes differed. https://example.com/ — meta deskripsi dan word count berubah.
  • URL atau template filter
  • Adalah vendor masalah menyebut diperlakukan sebagai setara?
  • Added — ternormalisasi URL tampak hanya di setelah ekspor. Dihapus — ini tampak hanya di sebelum ekspor. Berubah — di least satu mutually dipetakan bukti field differs. Diabaikan kolom — sumber data adalah preserved di original berkas tetapi tidak given cross-vendor arti di sini.

Cara kerja

Bagaimana adalah jalur template created? grouping replaces numeric IDs, UUIDs, dan long hexadecimal tokens di jalur segments. Ini adalah deterministik triage aid, tidak CMS-aware template detector. Berbeda rayapi configurations adalah largest confounder. alat tidak reproduce perenderan modes, authentication, robots perilaku, custom extraction, vendor scoring, rayapi penjadwalan, atau situs completeness. Ini tidak infer yang dua secara berbeda named vendor memeriksa mean sama thing. Template grouping adalah jalur-shape grouping, tidak dipelajari CMS template klasifikasi. laporan adalah triage bukti, tidak proof dari regresi. Melakukan added atau dihapus URL buktikan crawlability perubahan?

Batasan

  • alat recognizes umum halaman-ekspor header dari Screaming Frog, Sitebulb, Scout Situs Audit Gratis, dan generik CSV atau TSV berkas. Ini needs URL kolom dan membandingkan hanya fields recognized di keduanya berkas.
  • Berubah URLs
  • Gratis, tanpa pendaftaran. Bandingkan dua rayapi ekspor tanpa forcing unlike vendor masalah taxonomies menjadi fake equivalence. Bersama halaman bukti adalah ternormalisasi; belum dipetakan kolom dan tidak lengkap rayapi cakupan tetap terlihat.
  • Menormalkan dan bandingkan dua Screaming Frog, Sitebulb, Scout, atau generik rayapi ekspor secara lokal oleh URL, field, dan jalur template.

Pertanyaan umum

Ekspor crawl apa yang dapat saya bandingkan?

Alat mengenali header ekspor halaman umum dari Screaming Frog, Sitebulb, Scout Site Audit Free, serta berkas CSV atau TSV generik. Alat memerlukan kolom URL dan hanya membandingkan bidang yang dikenali dalam kedua berkas.

Apakah nama masalah dari vendor dianggap setara?

Tidak. Taksonomi masalah khusus vendor dapat memiliki definisi dan ambang berbeda. Pembanding menormalkan bukti halaman bersama seperti status, indexability, title, canonical, H1, jumlah kata, depth, dan inlinks. Label masalah hanya dibandingkan sebagai teks literal yang diurutkan ketika kedua berkas menyediakannya.

Apakah URL yang ditambahkan atau dihapus membuktikan perubahan crawlability?

Tidak. URL dapat muncul atau hilang karena cakupan crawl, batas, autentikasi, aturan robots, pengaturan, atau perubahan situs nyata. Pastikan konfigurasi crawl sebanding sebelum menganggap perbedaan inventaris sebagai regresi.

Apakah ekspor diunggah?

Tidak. Penguraian, normalisasi, perbandingan, pemfilteran, dan ekspor CSV berlangsung di browser. Berkas yang dipilih tidak dikirim ke situs ini.

Bagaimana template jalur dibuat?

Pengelompokan mengganti ID numerik, UUID, dan token heksadesimal panjang dalam segmen jalur. Ini adalah bantuan triase deterministik, bukan detektor template yang memahami CMS.

Langkah berikutnyaGenerator Sitemap XML — generate the corrected version. Panduan tersedia dalam bahasa Inggris.