Cara Setting Robots.txt Blogger dan Custom Robots Tags
Namun pengaturan ini tidak perlu diubah hanya karena ingin membuat Blogger menjadi “lebih SEO”. Blogger sudah mempunyai konfigurasi bawaan. Custom robots.txt dan custom robots tags lebih tepat digunakan ketika kita memang memahami aturan yang ingin diterapkan dan mempunyai kebutuhan khusus.
Kesalahan terbesar yang sering terjadi adalah menganggap robots.txt sebagai alat untuk memerintahkan mesin pencari agar mengindeks atau tidak mengindeks halaman. Padahal robots.txt terutama berfungsi mengatur crawling. Untuk mengendalikan indexing halaman, kita menggunakan robots meta/header seperti noindex.
Robots.txt dan Robots Tag Itu Berbeda
Memberi petunjuk kepada crawler mengenai path yang boleh atau tidak boleh dirayapi.
Memberikan aturan seperti index, noindex, follow, nosnippet dan lainnya.
Perbedaan ini sangat penting. Memblokir sebuah URL melalui robots.txt tidak sama dengan meminta Google menghapus URL tersebut dari indeks.
Jika tujuan kita adalah membuat suatu halaman tidak muncul di Google, aturan noindex lebih tepat. Halamannya juga harus tetap dapat dirayapi agar crawler dapat menemukan aturan noindex tersebut.
Apa Itu Robots.txt Blogger?
Robots.txt adalah file teks pada root sebuah website yang berisi aturan untuk crawler. Pada Blogger kita dapat melihatnya dengan membuka alamat blog kemudian menambahkan /robots.txt.
Blogger menyediakan robots.txt secara otomatis. Jika opsi Enable custom robots.txt diaktifkan, isi custom yang kita masukkan akan digunakan sebagai robots.txt blog.
Apakah Custom Robots.txt Wajib Diaktifkan?
Tidak. Custom robots.txt adalah fitur tambahan. Mengaktifkannya bukan syarat agar Blogger dapat diindeks oleh Google.
Bahkan jika kita tidak membutuhkan aturan khusus, membiarkannya menggunakan konfigurasi bawaan Blogger dapat mengurangi risiko salah memblokir crawler.
Cara Mengaktifkan Custom Robots.txt Blogger
Buka dashboard Blogger kemudian pilih blog yang ingin diatur.
Pilih menu Setelan lalu scroll ke bagian Crawler dan pengindeksan.
Aktifkan slider Enable custom robots.txt jika memang ingin menggunakan aturan custom.
Klik pengaturan robots.txt kemudian masukkan aturan yang diperlukan.
Setelah disimpan, buka /robots.txt pada domain blog untuk memeriksa hasilnya.
Contoh Robots.txt Blogger yang Sederhana
Jika memang ingin menggunakan custom robots.txt, konfigurasi sebaiknya dibuat sesederhana mungkin. Contoh berikut memperbolehkan crawler mengakses blog sambil mencantumkan alamat sitemap.
Allow: /
Sitemap: https://www.domainanda.com/sitemap.xml
Ganti www.domainanda.com dengan domain Blogger atau custom domain yang benar-benar digunakan.
Contoh Memblokir Halaman Pencarian Blogger
Jika mempunyai alasan khusus untuk membatasi crawling halaman pencarian internal Blogger, salah satu contoh rule yang sering digunakan adalah:
Disallow: /search
Allow: /
Sitemap: https://www.domainanda.com/sitemap.xml
Jangan Gunakan Robots.txt untuk Noindex
Jika ingin sebuah artikel atau halaman tidak muncul pada hasil pencarian, jangan hanya memblokir URL tersebut dengan robots.txt.
Google perlu dapat mengakses halaman agar dapat melihat aturan noindex. Jika URL diblokir robots.txt, crawler bisa tidak pernah membaca robots meta tag yang terdapat pada halaman.
Disallow: /halaman-rahasia
Memblokir crawling tetapi bukan mekanisme noindex.
noindex
Memberitahu crawler agar halaman tidak dimasukkan ke indeks.
Arti User-agent Allow Disallow dan Sitemap
Kesalahan Robots.txt yang Harus Dihindari
Disallow: / pada user-agent umum dapat mencegah crawler mengakses hampir seluruh situs.
Nama Web Crawler yang Umum Ditemui
Cara Setting Custom Robots Header Tags Blogger
Blogger juga menyediakan custom robots header tags. Berbeda dengan robots.txt, fitur ini berhubungan dengan robots directives yang dikirim kepada search engine untuk jenis halaman tertentu.
Pengaturan ini juga tidak wajib diaktifkan. Jika tidak mempunyai kebutuhan khusus, konfigurasi default Blogger dapat dipertahankan.
Home Page Tags
Untuk halaman beranda yang memang ingin tampil secara normal di mesin pencari, kita tidak membutuhkan noindex. Jika memilih melakukan konfigurasi custom, jangan mengaktifkan directive yang bertentangan dengan tujuan tersebut.
Archive and Search Page Tags
Halaman archive dan internal search berbeda dari artikel utama. Jika memang ingin halaman jenis ini tidak muncul di hasil pencarian, Blogger menyediakan directive seperti noindex melalui robots header settings.
Post and Page Tags
Postingan dan halaman yang memang ingin tampil pada mesin pencari sebaiknya tidak diberi directive noindex. Blogger bahkan menyediakan custom robots tags per posting jika kita ingin menyembunyikan artikel tertentu saja.
Contoh Konfigurasi Robots Header yang Konservatif
Jangan aktifkan noindex jika beranda memang ingin muncul di search.
Dapat digunakan jika Anda memang tidak ingin halaman internal tersebut tampil sebagai hasil pencarian.
Artikel utama tidak perlu noindex kecuali memang sengaja ingin disembunyikan dari search.
Cara Menyembunyikan Satu Artikel dari Google
Untuk menyembunyikan artikel tertentu, Blogger menyediakan pengaturan Custom robots tags pada editor posting. Aktifkan No index hanya pada halaman yang memang tidak ingin ditampilkan di search.
Sitemap Blogger dan Google Search Console
Sitemap membantu search engine menemukan URL yang tersedia pada sebuah website. Untuk Blogger, salah satu alamat sitemap utama yang dapat diperiksa adalah:
Sitemap dapat dikirim melalui bagian Sitemaps di Google Search Console. Setelah dikirim, Search Console dapat menampilkan status pemrosesan dan error jika sitemap bermasalah.
Sitemap yang Perlu Disubmit
Untuk kebanyakan Blogger, mulai dari sitemap utama terlebih dahulu:
Jika Blogger menyediakan sitemap halaman statis dan memang ingin memantaunya secara terpisah, Anda juga dapat memeriksa:
Tidak perlu memasukkan banyak feed hanya agar terlihat lebih lengkap. Sitemap yang valid dan berisi canonical URL yang memang ingin tampil di search sudah lebih penting daripada jumlah file yang disubmit.
Sitemap Tidak Menjamin Semua Artikel Terindeks
Submit sitemap berarti kita memberi tahu Google mengenai lokasi daftar URL. Google tetap menentukan kapan sebuah URL dirayapi, apakah URL tersebut canonical, dan apakah halaman layak dimasukkan ke indeks.
Jika Artikel Tidak Terindeks
Pengaturan yang Tidak Perlu Dibuat Terlalu Rumit
Pada Blogger, konfigurasi crawler yang sederhana biasanya lebih mudah dirawat. Jangan membuat puluhan aturan bot hanya karena crawler tersebut tersedia.
Rule per crawler lebih cocok digunakan jika memang terdapat alasan teknis yang jelas. Untuk blog biasa, rule umum jauh lebih mudah diperiksa dan lebih kecil kemungkinan menyebabkan masalah.
Referensi Resmi
Butuh Bantuan Memperbaiki Indexing Blogger?
CodeFlare dapat membantu memeriksa robots.txt, custom robots tags, sitemap, canonical URL, schema, redirect, Search Console, custom domain, internal link, atau masalah template Blogger yang membuat artikel sulit dirayapi dan diindeks.
DISKUSIKAN BLOGUntuk blog yang sudah berjalan normal, saya lebih memilih menjaga konfigurasi crawler tetap sederhana daripada menambahkan banyak rule yang sebenarnya tidak dibutuhkan. Robots.txt bukan tempat untuk melakukan semua optimasi SEO.
Yang jauh lebih penting adalah memastikan artikel dapat dirayapi, tidak mempunyai noindex yang salah, canonical benar, sitemap dapat dibaca, dan struktur internal link membantu crawler menemukan konten penting.
No comments
💬 Share Your Thoughts & Join the Hall of Fame!
Punya pendapat atau tips tentang artikel ini? Tuliskan komentar kamu sekarang! 🚀
💎 Komentar yang bermanfaat, relevan, dan positif berkesempatan tampil di CodeFlare Hall of Fame dan masuk ke Top Commentators Widget.
👉 Comment now. Share your ideas. Get noticed on codeflare.net