Membatasi konten di AI Overviews atau AI Mode tidak sama dengan memblokir semua bot AI. Untuk fitur AI di Google Search, kontrol yang relevan adalah akses Googlebot serta pengaturan indeks dan cuplikan halaman. Memblokir Google-Extended bukan pengganti pengaturan tersebut. Salah memilih kontrol bisa menghilangkan cuplikan yang membantu calon klien memahami layanan, bahkan mengeluarkan halaman dari pencarian biasa.
Panduan ini menjawab keputusan yang sering tercampur: bagian mana yang boleh tampil sebagai cuplikan, bagian mana yang tetap boleh ditemukan, dan bagian mana yang seharusnya tidak pernah dipublikasikan. Fokusnya bukan trik agar dikutip AI, melainkan pembatasan informasi yang bisa diuji.
Dalam riset tujuh hari terakhir, perubahan resmi Search Central pada 1 Oktober 2026 menegaskan pemeriksaan manual konten generatif, termasuk metadata. Perubahan itu tidak memperkenalkan kontrol AI baru. Ia menjadi alasan untuk memeriksa informasi yang benar-benar disajikan halaman, bukan hanya paragraf utama (catatan pembaruan Google, panduan konten generatif). Mekanisme kontrol di bawah berasal dari dokumentasi resmi yang sudah ada; jangan menganggapnya fitur yang baru diluncurkan minggu ini.
Tentukan informasi yang ingin dibatasi terlebih dahulu
Mulai dari satu URL dan satu alasan bisnis. Misalnya, halaman studi kasus berisi proses proyek yang boleh dipublikasikan, tetapi ada paragraf yang tidak ingin digunakan sebagai cuplikan pencarian. Kebutuhannya berbeda dari proposal privat yang hanya boleh dibaca klien tertentu.
Untuk studi kasus publik, pengaturan cuplikan mungkin relevan. Untuk proposal privat, gunakan autentikasi dan kontrol akses server. Robots bukan pagar keamanan: orang tetap bisa membuka URL publik secara langsung, membagikannya, atau menyalin isinya. Jangan menaruh data rahasia di halaman publik sambil berharap atribut HTML membuatnya aman.
Buat inventaris kecil: URL, pemilik konten, informasi yang sensitif, tujuan publikasi, kontrol yang dipilih, dan tanggal pemeriksaan. Inventaris ini mencegah keputusan global untuk masalah yang sebenarnya hanya terjadi pada satu bagian halaman.
1. Googlebot: akses untuk Google Search
Google menyatakan bahwa Googlebot adalah kontrol akses crawling untuk Search, termasuk fitur AI yang menjadi bagian dari Search. Jika ingin halaman ditemukan melalui pencarian biasa maupun fitur AI, jangan memblokir Googlebot tanpa memahami akibatnya (AI features and your website).
Ada jebakan penting: ketika URL diblokir melalui robots.txt, Google tidak bisa membaca instruksi baru yang Anda letakkan pada halaman itu. Memasang noindex lalu menutup crawling sekaligus bukan cara yang andal untuk menyampaikan perubahan. Dokumentasi robots menegaskan bahwa pengaturan halaman harus dapat diakses crawler agar dibaca dan diikuti (spesifikasi robots).
Untuk situs jasa, keputusan praktisnya sederhana. Jangan menutup direktori layanan atau blog hanya karena satu paragraf perlu dibatasi. Tentukan kontrol pada tingkat halaman atau bagian teks terlebih dahulu. Perubahan akses crawling menyentuh jalur penemuan konten, bukan sekadar tampilan cuplikan.
2. Google-Extended: tujuan berbeda dari Search
Google membedakan kontrol Search dari pembatasan pelatihan dan grounding pada sebagian sistem Google lainnya. Panduan fitur AI Search mengarahkan pemilik situs ke Google-Extended untuk tujuan kedua tersebut, bukan sebagai kontrol AI Overviews atau AI Mode (panduan Google).
Karena itu, kalimat seperti “Google-Extended diblokir, berarti halaman tidak akan muncul di AI Search” keliru. Catat kedua keputusan secara terpisah: kebijakan penggunaan konten oleh produk lain, dan visibilitas di Search. Tim legal atau pemilik bisnis bisa punya kebutuhan berbeda untuk keduanya.
Artikel ini tidak menyarankan membuka atau menutup crawler tersebut secara otomatis. Keputusan lisensi, akses, dan penggunaan konten perlu disepakati pemilik informasi. Yang harus dicegah adalah mengubah aturan dengan asumsi bahwa semua produk Google menggunakan satu token crawler.
3. nosnippet: pembatasan luas pada satu halaman
Instruksi nosnippet mencegah cuplikan teks atau preview video untuk halaman dalam hasil pencarian. Dokumentasi juga menyatakan bahwa kontrol ini mencegah konten dipakai sebagai input langsung untuk AI Overviews dan AI Mode. Thumbnail gambar statis masih dapat ditampilkan ketika memberi pengalaman yang lebih baik (spesifikasi nosnippet).
Ini bukan tombol yang hanya memengaruhi AI. Dampaknya juga menyentuh hasil pencarian biasa. Halaman mungkin tetap ditemukan, tetapi calon pengunjung kehilangan sebagian konteks yang sebelumnya muncul dalam cuplikan. Untuk halaman layanan yang membutuhkan penjelasan singkat sebelum diklik, konsekuensi tersebut perlu dipertimbangkan.
Bedakan pula nosnippet dari max-snippet. Yang kedua membatasi panjang cuplikan dan jumlah konten yang dapat digunakan sebagai input langsung sesuai ketentuannya. Jangan memilih angka acak karena dianggap “ramah AI”. Panjang yang tepat bergantung pada keputusan editorial, bukan rumus sitasi. Dokumentasi mencatat pengecualian untuk penggunaan yang diizinkan secara terpisah, termasuk informasi melalui structured data atau perjanjian lisensi.
4. data-nosnippet: batasi bagian teks tertentu
Jika hanya satu bagian halaman yang perlu dikecualikan dari cuplikan, data-nosnippet memberi kontrol yang lebih sempit. Google mendokumentasikan atribut ini pada elemen span, div, dan section. Gunakan HTML valid, tutup elemen dengan benar, dan jangan memasangnya pada elemen lain sambil mengasumsikan hasilnya sama (panduan data-nosnippet).
Contoh keputusan editorial: proses proyek tetap dijelaskan, tetapi bagian catatan tambahan tidak digunakan sebagai cuplikan. Itu bukan jaminan bahwa informasi menjadi privat atau mustahil disebut di tempat lain. Kontrol ini mengatur pemakaian cuplikan oleh Google, bukan menghapus teks dari internet.
Ada detail yang mudah terlewat. data-nosnippet adalah atribut boolean; memberikan nilai false tidak menonaktifkannya. Google juga menjelaskan bahwa structured data tetap dapat digunakan untuk hasil pencarian meskipun dideklarasikan di dalam elemen dengan atribut ini. Artinya, membungkus teks bukan pengganti pemeriksaan JSON-LD.
Pada Astro SSR, masukkan atribut ke HTML yang dikirim server jika keputusan itu memang diperlukan. Hindari menambah atau menghapusnya setelah halaman termuat melalui JavaScript. Dokumentasi menyebut ekstraksi dapat terjadi sebelum atau sesudah rendering; perubahan dinamis menciptakan ketidakpastian yang tidak perlu.
5. noindex: keluarkan halaman, bukan hanya cuplikannya
noindex adalah pilihan yang jauh lebih luas. Instruksi ini menyatakan agar halaman tidak ditampilkan dalam hasil pencarian. Google mensyaratkan halaman terindeks dan memenuhi syarat untuk menampilkan snippet agar dapat menjadi tautan pendukung dalam AI Overviews atau AI Mode (syarat fitur AI).
Jangan menerapkannya pada halaman jasa aktif hanya untuk membatasi penggunaan satu kalimat. Pertanyaan pertama harus tetap bisnis: apakah halaman ini memang tidak perlu ditemukan lewat Search? Jika jawabannya tidak, periksa pilihan cuplikan yang lebih sempit.
noindex juga bukan perlindungan dokumen privat. Untuk file non-HTML, Google mendokumentasikan X-Robots-Tag sebagai mekanisme pengaturan indeks. Namun siapa pun yang memiliki URL publik tetap dapat mengakses file tersebut selama server mengizinkannya. Gunakan pembatasan akses untuk informasi rahasia, bukan menggantungkan keamanan pada instruksi mesin pencari.
Cara menguji perubahan tanpa mengambil kesimpulan terlalu cepat
Lakukan pemeriksaan berurutan pada satu URL yang telah disepakati. Ini prosedur verifikasi, bukan eksperimen untuk mengejar ranking.
- Simpan baseline. Catat status HTTP, canonical, robots meta,
X-Robots-Tag, dan isi JSON-LD sebelum perubahan. Simpan alasan editorialnya. - Periksa respons server. Pastikan instruksi muncul dalam HTML awal atau header yang tepat. Untuk
data-nosnippet, periksa batas elemen dan bagian teks yang tercakup. - Periksa akses crawling. Pastikan robots.txt atau proteksi CDN tidak mencegah Google membaca instruksi halaman yang ingin Anda sampaikan.
- Gunakan URL Inspection jika memiliki akses. Periksa HTML yang diterima Googlebot. Status halaman live dan data versi terindeks tidak selalu merepresentasikan waktu yang sama.
- Tunggu pemrosesan ulang. Google menyebut recrawl dapat memerlukan beberapa hari sampai beberapa bulan, tergantung penilaian sistem terhadap kebutuhan pembaruan. Tidak ada janji waktu yang berlaku untuk semua URL (troubleshooting preview controls).
Tentukan ukuran kegagalan sebelum implementasi. Jika elemen yang salah ikut terbungkus, itu bug HTML. Jika header noindex tersebar ke halaman layanan lain, itu bug cakupan. Jika Googlebot tidak bisa membaca instruksi karena akses ditutup, itu konflik konfigurasi. Ketiganya berbeda dari perubahan ranking harian dan bisa diperiksa tanpa menunggu laporan trafik.
Keputusan untuk situs jasa saat rollout Google
Saat artikel ini disusun, September 2026 spam update masih tercatat berjalan, dimulai 24 September. Status bisa diperiksa di Google Search Status Dashboard. Jangan menyimpulkan naik atau turunnya trafik sebagai akibat sebuah kontrol selama rollout.
Untuk situs ini, contoh kontrol di atas bukan instruksi mengubah robots.txt, template, atau indeks secara massal. Audit dapat dilakukan sekarang; keputusan struktural menunggu rollout selesai dan masa evaluasi yang ditetapkan pemilik situs. Pengecualian seperti informasi rahasia yang terpublikasi perlu ditangani sebagai masalah keamanan, bukan menunggu eksperimen SEO.
Jika kebutuhan Anda justru memperbaiki peluang muncul di AI Search, mulai dari konten yang berguna, akses halaman, dan kejelasan informasi. Google tidak mewajibkan file llms.txt atau schema khusus AI (panduan optimasi AI Google). Untuk konteks pengukuran, baca cara membaca laporan AI Search Console; untuk pemeriksaan sebelum terbit, gunakan checklist review konten AI.
Butuh memetakan kontrol pada website bisnis? Mulai konsultasi melalui jasa SEO dengan daftar URL dan tujuan pembatasan. Hasil yang perlu disepakati adalah keputusan yang terdokumentasi dan bisa diverifikasi, bukan janji bahwa satu tag menjamin atau melarang semua sitasi AI.