Generator Sitemap XML
Bounded and polite: at most three page requests run at once; each request is capped at 900 KB/10 seconds, and the server also rate-limits each target host. This is a sitemap seed, not a full-site crawler.
Pemeriksaan dijalankan dari server kami; kami mengambil URL yang Anda masukkan dan tidak menyimpan hasilnya. The start site, its robots.txt, and eligible same-host HTML pages are sent through this site's bounded fetch endpoints. Crawl decisions and XML generation run in your browser. Penghitung hasil anonim per proses dapat digunakan untuk riset agregat; URL, domain, IP, dan pengenal tidak pernah disertakan, dan statistik tidak dirilis jika jumlah proses kurang dari 100.
+ menyimpan situs atau halaman saat ini. Gunakan ☆ di samping situs, halaman, atau daftar tersimpan untuk menambahkannya ke favorit. Riwayat pemeriksaan terbaru muncul di bawah.
Buat daftar bernama
Target diisi dari pilihan lokal Anda.
Paspor situs Konteks lokal untuk situs tersimpan ini
Data lokal
Target tersimpan, daftar bernama, dan ringkasan pemeriksaan terbaru hanya tersimpan di browser ini.
Sitemap output
Excluded
Unknown / not included
Nilai alat ini
Tentang alat ini
Bagaimana adalah lastmod dipilih?
Rayapi dibatasi atur dari sama-situs halaman, respect robots.txt, exclude noindex dan off-canonical URLs, dan unduh honest XML sitemap.
Mulai URL Maximum halaman 25 50 100 200 (maximum) Rayapi dan hasilkan Coba contoh Dibatasi dan polite: di paling tiga halaman permintaan jalankan di once; setiap permintaan adalah capped di 900 KB/10 seconds, dan server juga nilai-batasan setiap target host. Ini adalah sitemap seed, tidak penuh-situs perayap.
Fitur
- Halaman dengan noindex header atau meta tag, halaman whose canonical menunjuk di tempat lain, dan URLs disallowed untuk Googlebot di robots.txt adalah dikecualikan. Gagal, non-HTML, truncated, dan non-2xx respons stay di terpisah tidak diketahui keadaan.
- Akan ini rayapi my entire situs?
- Hanya valid HTTP Terakhir-Modified header, terlihat waktu datetime, atau JSON-LD dateModified/datePublished nilai adalah dihasilkan. alat tidak pernah stamps setiap halaman dengan today’s tanggal.
- Sitemap keluaran Validasi sitemap berikutnya → Dikecualikan Tidak diketahui / tidak disertakan
- Tidak. Anda pilih hard cap up untuk 200 halaman. alat keadaan ketika antrean adalah masih non-kosong di yang cap, so capped rayapi tidak pernah presented sebagai lengkap.
Cara kerja
Hasilkan XML sitemap dari capped, robots-respecting sama-situs rayapi. Noindex, off-canonical, gagal, dan tidak pasti URLs tetap visibly terpisah; lastmod tanggal adalah dihasilkan hanya ketika halaman provides bukti.
Batasan
- Yang halaman adalah dikecualikan?
Pertanyaan umum
Apakah alat ini melakukan crawl pada seluruh situs saya?
Tidak. Anda memilih batas keras hingga 200 halaman. Alat menyatakan ketika antrean masih belum kosong saat batas tercapai, sehingga crawl terbatas tidak pernah ditampilkan sebagai crawl lengkap.
Halaman mana yang dikecualikan?
Halaman dengan header atau tag meta noindex, halaman yang canonical-nya menunjuk ke tempat lain, dan URL yang tidak diizinkan untuk Googlebot dalam robots.txt dikecualikan. Respons gagal, non-HTML, terpotong, dan non-2xx tetap berada dalam status unknown yang terpisah.
Bagaimana lastmod dipilih?
Hanya header HTTP Last-Modified yang valid, datetime pada elemen time yang terlihat, atau nilai dateModified/datePublished JSON-LD yang dikeluarkan. Alat tidak pernah memberi tanggal hari ini pada setiap halaman.
Masalah umum dan cara memperbaikinya
- Peringatan Noindex halaman adalah dikecualikan dari sitemap Perbaikan: Hapus noindex jika halaman seharusnya menjadi diindeks; jika tidak pertahankan ini dikecualikan dari sitemap.
- Peringatan Non-200 halaman adalah dikecualikan dari sitemap Perbaikan: Pulihkan langsung 200 respons untuk canonical halaman atau biarkan non-200 URL keluar dari sitemap.
- Peringatan Halaman canonicalized di tempat lain adalah dikecualikan Perbaikan: Termasuk hanya canonical tujuan dan pertahankan URL canonicalized di tempat lain keluar dari sitemap.
- Informasi Duplikat URL adalah dihapus Perbaikan: Pertahankan satu ternormalisasi canonical URL entry dan hapus duplikat spellings atau parameter varian.
- Peringatan Tidak valid URL adalah dikecualikan Perbaikan: Benar cacat absolut URL sebelum adding ini untuk sitemap.
- Peringatan Cross-host URL adalah dikecualikan Perbaikan: Hasilkan terpisah sitemap untuk lain terverifikasi host dan pertahankan sitemap host-spesifik.