Generator robots.txt untuk crawler AI
Izinkan atau blokir setiap crawler AI dengan pemahaman penuh, lalu salin blok kode untuk ditambahkan ke robots.txt Anda.
GPTBot mengumpulkan halaman untuk melatih model OpenAI. Memblokirnya tidak berpengaruh apa pun terhadap keberadaan Anda di ChatGPT. OAI-SearchBot, di sisi lain, memasok indeks pencarian ChatGPT: dialah yang menentukan apakah halaman Anda dapat diambil, diringkas, dan dikutip lengkap dengan tautan. Memblokirnya akan menghilangkan Anda dari jawaban ChatGPT. Banyak situs menyalin aturan blokir GPTBot lalu menambahkan OAI-SearchBot "untuk berjaga-jaga", dan tanpa sadar menghilangkan diri mereka sendiri dari jalur trafik yang justru sedang mereka perjuangkan. Putuskan baris demi baris, jangan sekaligus.
Mengumpulkan halaman untuk melatih model OpenAI.
Memblokirnya tidak menghilangkan Anda dari jawaban ChatGPT. Ini adalah keputusan soal data Anda, bukan soal visibilitas Anda.
Mengindeks halaman untuk pencarian ChatGPT.
Crawler inilah yang menentukan kehadiran dan tautan Anda dalam jawaban ChatGPT. Memblokirnya akan menghapus Anda dari kutipan.
Memeriksa halaman tujuan (landing page) untuk iklan ChatGPT Ads.
Diperlukan jika Anda berencana membeli iklan di ChatGPT: tanpa crawler ini, halaman tujuan Anda tidak dapat divalidasi.
Mengambil halaman secara langsung karena pengguna membagikan tautannya atau bertanya tentangnya.
Trafik yang dipicu oleh orang sungguhan, secara real-time. Memblokirnya sama saja dengan menolak kunjungan yang secara eksplisit diminta.
Mengumpulkan halaman untuk model Claude.
Anthropic juga menggunakan Claude-User untuk pengambilan langsung dan Claude-SearchBot untuk pencarian: keduanya agent terpisah yang perlu diperlakukan secara terpisah pula.
Mengindeks halaman untuk jawaban Perplexity yang menyertakan sumber.
Perplexity selalu menampilkan sumbernya. Memblokirnya berarti melepaskan kutipan tersebut beserta trafik yang menyertainya.
Token yang mengatur penggunaan konten Anda untuk Gemini dan penjangkaran (grounding) jawaban.
Ini bukan crawler penjelajah: token ini tidak mengubah pengindeksan maupun peringkat Anda di Google Search.
Membentuk korpus publik yang digunakan ulang oleh banyak proses pelatihan model.
Tidak ada manfaat visibilitas secara langsung: Common Crawl tidak mengutip siapa pun. Ini kandidat pertama untuk diblokir jika Anda ingin melindungi data Anda.
Mengumpulkan halaman untuk model ByteDance.
Dikenal karena kecepatan crawl yang agresif. Banyak situs memblokirnya baik karena alasan beban server maupun alasan hak cipta.
Mengumpulkan halaman untuk model Meta dan Meta AI.
Meta menggunakan beberapa agent. Yang ini adalah agent crawler yang didokumentasikan resmi untuk keperluan pelatihan model.
Token yang mengatur penggunaan konten Anda untuk Apple Intelligence.
Token ini tidak memengaruhi Applebot, yang memasok Siri dan Spotlight: keberadaan Anda di pencarian Apple tidak terpengaruh.
Tambahkan blok ini ke file robots.txt Anda yang sudah ada, di root domain. Jangan menimpa aturan Anda yang sekarang: robots.txt dibaca per kelompok User-agent, jadi aturan Anda tetap berlaku untuk crawler lainnya.
Alat ini berjalan sepenuhnya di peramban Anda. Tidak ada data yang Anda masukkan di sini yang dikirim ke server kami, tidak ada yang disimpan, dan tidak perlu membuat akun atau mematuhi kuota apa pun. Karena itu kami bisa menyediakannya secara cuma-cuma: alat ini tidak memakan biaya apa pun bagi kami.
Apa yang dilakukan alat ini
robots.txt yang tidak dikonfigurasi dengan tepat adalah cara tercepat untuk menghilang dari jawaban AI tanpa Anda sadari. Kebingungan paling umum dan paling merugikan menyangkut OpenAI: GPTBot dan OAI-SearchBot tidak menjalankan tugas yang sama, dan memblokir salah satunya alih-alih yang lain memberi dampak yang justru berkebalikan. Alat ini menampilkan peran sebenarnya dari setiap crawler sebelum Anda mengambil keputusan.
- Sebelas crawler AI dicakup, masing-masing dengan peran sebenarnya: pelatihan model, pencarian dan kutipan, kunjungan yang dipicu pengguna, iklan.
- Empat preset, termasuk satu yang tetap mempertahankan kutipan sambil menolak pengumpulan data untuk pelatihan.
- Penambahan jalur terlarang yang berlaku untuk crawler yang Anda izinkan lewat, guna melindungi area akun pelanggan atau keranjang belanja.
- Baris Sitemap ditambahkan di akhir file, disertai komentar yang mengingatkan peran setiap crawler.
- Dibuat secara lokal: file dibuat langsung di peramban Anda, tidak ada yang dikirimkan ke mana pun.
Pertanyaan yang sering diajukan
Apakah memblokir GPTBot membuat saya menghilang dari ChatGPT?
Apakah crawler benar-benar mematuhi robots.txt?
Di mana file ini harus diletakkan?
Bisakah saya memblokir hanya sebagian situs saja?
Bagaimana cara memeriksa apakah aturan saya benar-benar diterapkan?
Melangkah lebih jauh dari sekadar generator
Micro-alat ini menghasilkan sebuah file. Scanner Ready2GEO justru memeriksa langsung apa yang sebenarnya terjadi di situs Anda dan dalam jawaban mesin AI.
Memeriksa apakah situs Anda benar-benar memenuhi syarat dan dapat digunakan oleh platform iklan ChatGPT: akses crawler, struktur, sinyal komersial.
Uji situs saya 🕷️ Penganalisis log crawler AITempelkan log server Anda: lihat crawler AI mana yang benar-benar mengunjungi situs Anda, seberapa sering, dan di halaman mana mereka mengalami kendala.
Analisis log saya 🧭 Audit GEO lengkapAudit gabungan ini menyatukan semua scanner ke dalam satu laporan, lengkap dengan perbaikan yang sudah diprioritaskan dan ekspor PDF.
Jalankan audit