Search Console menengah
Crawled – Currently Not Indexed
Google sudah datang, membaca halamannya, dan memutuskan untuk tidak menyimpannya, setidaknya untuk saat ini. Status ini bukan bug, dan meminta indexing ulang tidak mengubahnya. Yang mengubahnya adalah alasan Google menolak, dan alasan itu biasanya bisa ditebak dari pola URL-nya.
Status ini muncul di laporan Page indexing di bawah "Why pages aren't indexed", dan di URL Inspection sebagai alasan "URL is not on Google". Google menjelaskannya singkat: halaman sudah di-crawl tapi belum diindeks, dan mungkin akan diindeks nanti tanpa perlu mengirim ulang. Dalam praktik, kalau status ini bertahan lebih dari beberapa minggu untuk halaman yang penting, Google sedang memberi tahu sesuatu tentang halaman itu.
Gejala, penyebab, cek pertama
| Gejala | Kemungkinan penyebab | Cek pertama |
|---|---|---|
Banyak URL dengan parameter, filter, atau varian (?sort=, ?warna=) | Google menganggapnya duplikat atau bernilai rendah, tapi tidak menemukan canonical yang tegas | Apakah URL-URL itu punya canonical ke versi utama? Apakah seharusnya diblokir atau noindex? |
| Halaman tag, arsip, hasil pencarian internal, halaman paginasi dalam | Isinya daftar kutipan yang sudah ada di halaman lain; nilai tambahnya tipis | Apakah halaman itu memang perlu diindeks? Sebagian besar tidak |
| Artikel baru di situs baru atau situs dengan sedikit sinyal | Google belum yakin situs ini layak diberi ruang indeks; keputusan ditunda | Berapa banyak halaman lain di situs yang sudah diindeks? Apakah ada link dari luar ke situs? |
| Halaman produk dengan deskripsi yang sama dengan ribuan toko lain | Duplikat lintas situs; Google memilih versi dari situs lain | Apakah ada konten unik di halaman itu selain deskripsi pabrikan? |
| Halaman yang isinya sebagian besar dimuat lewat JavaScript | Render gagal atau tertunda; yang Google lihat adalah halaman kosong | URL Inspection → View crawled page → HTML: apakah konten ada di sana? |
| Halaman tipis: 100–200 kata, atau isinya sudah dijawab halaman lain di situs yang sama | Nilai tambah dianggap tidak cukup | Bandingkan dengan halaman serupa di situs yang diindeks: apa bedanya? |
| Halaman yang dibuat massal dengan template (kota × layanan, kombinasi keyword) | Pola scaled content abuse; Google menolak secara sistematis | Berapa persen halaman jenis ini yang diindeks? Kalau kecil, polanya yang ditolak |
| Halaman penting yang tadinya diindeks, lalu berubah status ini | Google menilai ulang setelah core update, atau ada perubahan di halaman/situs | Cek tanggal perubahan status vs tanggal update Google dan tanggal perubahan situs |
Apa yang sebenarnya terjadi
Tidak ada dokumentasi Google yang merinci kriteria keputusan indeks, tapi pernyataan-pernyataan publik dari Google (terutama John Mueller dan Gary Illyes) konsisten pada satu hal: Google tidak mengindeks semua yang ia crawl, dan pilihannya bergantung pada apakah halaman itu menambah sesuatu yang belum ada di indeks. Kualitas di sini bukan hanya soal halaman itu sendiri; Google juga mempertimbangkan kualitas situs sebagai satu kesatuan. Situs yang sebagian besar halamannya bernilai rendah membuat halaman barunya lebih sulit diindeks, bahkan yang bagus. Hipotesis industri yang didukung banyak pengamatan: proporsi halaman berkualitas di sebuah situs memengaruhi kemauan Google mengindeks halaman berikutnya.
Prosedur diagnosis
- Ekspor daftar URLPage indexing → klik alasan "Crawled – currently not indexed" → Export. Maksimal 1.000 sampel; untuk situs besar, pola sudah terlihat dari sampel.
- Kelompokkan berdasarkan pola URLParameter, direktori, jenis halaman. Biasanya 80% URL jatuh ke dua atau tiga kelompok.
- Untuk tiap kelompok, tanya: apakah kelompok ini memang perlu diindeks?Kalau tidak (filter, tag, pencarian internal): pasang noindex atau canonical, dan berhenti mengkhawatirkannya. Status ini untuk halaman yang memang tidak perlu diindeks adalah kondisi normal.
- Untuk kelompok yang perlu diindeks, periksa renderURL Inspection → View crawled page → HTML pada dua-tiga URL. Kalau konten tidak ada: masalah rendering, bukan kualitas.
- Kalau render benar, periksa duplikasiCari kalimat pertama halaman di Google dengan tanda kutip. Kalau muncul di URL lain (di situs sendiri atau situs lain), itu duplikasi.
- Kalau tidak duplikat, periksa nilai tambahBandingkan dengan halaman yang berperingkat untuk query yang sama. Apa yang halaman kita tidak punya?
Tindakan per penyebab
| Penyebab | Tindakan | Cara verifikasi |
|---|---|---|
| Varian URL / parameter | Canonical ke versi utama; pertimbangkan robots.txt untuk parameter yang tidak berguna; perbaiki internal link supaya menunjuk versi utama | Status berubah jadi "Alternate page with proper canonical tag" atau "Blocked by robots.txt" |
| Halaman utilitas (tag, pencarian, arsip) | noindex | Status berubah jadi "Excluded by noindex tag" |
| Render gagal | Pastikan konten utama ada di HTML server; buka blokir sumber daya; perbaiki error JavaScript | View crawled page menampilkan konten; status berubah jadi diindeks setelah crawl ulang |
| Duplikat lintas situs | Tambahkan konten yang hanya ada di situs kita (ulasan, data, foto, konteks lokal); kalau tidak bisa, terima bahwa halaman itu tidak akan diindeks | Sampel URL diindeks dalam beberapa minggu |
| Halaman tipis | Gabungkan beberapa halaman tipis jadi satu yang menyeluruh dan redirect sisanya; atau perluas halaman itu | Halaman gabungan diindeks; yang di-redirect berstatus "Page with redirect" |
| Konten massal bertemplate | Hentikan pola itu; hapus (410) yang tidak punya nilai; sisakan yang benar-benar berbeda | Rasio diindeks pada kelompok itu naik |
| Situs baru / sinyal lemah | Perkuat internal link dari halaman yang sudah diindeks; dapatkan beberapa link dari luar; sabar | Perlahan berubah; cek tiap 2–4 minggu |
Bedanya dengan "Discovered – currently not indexed"
Keduanya berakhir dengan kata yang sama, tapi menunjuk masalah yang berbeda. Crawled: Google sudah mengambil halamannya, keputusannya tentang isi. Discovered: Google tahu URL-nya tapi belum mengambilnya, keputusannya tentang prioritas dan kapasitas. Yang kedua dibahas di halaman sendiri karena tindakannya berbeda.
Rujukan
- Page indexing report: Crawled - currently not indexed Search Console Help
- Creating helpful, reliable, people-first content Google Search Central
- Spam policies: scaled content abuse Google Search Central