← News & Analysis
AI & Web SecurityCLOUDFLAREBARU

Cloudflare pisahkan AI crawler jadi Search, Agent, dan Training — apa dampaknya buat website?

Cloudflare lagi mengubah cara website menghadapi AI crawler. Kalau sebelumnya kita cenderung berpikir “allow bot” atau “block bot”, sekarang policy bisa dibedakan berdasarkan tujuan traffic-nya. Buat website yang tetap mau ditemukan lewat search tapi lebih ketat soal AI training, update ini cukup penting.

AI crawler
Search / Agent / Training
Policy berbeda
Cek efek ke indexing

Apa yang berubah?

Cloudflare membagi tiga use case AI yang bisa dikontrol lebih jelas: Search untuk crawler yang membantu konten muncul di hasil pencarian, Agent untuk agent yang membuka halaman atas permintaan user, dan Training untuk crawler yang mengambil konten buat training atau fine-tuning model. Jadi, satu website nggak harus memakai keputusan yang sama untuk semua jenis traffic AI.

Default baru mulai 15 September 2026

Untuk domain baru yang onboarding ke Cloudflare, kategori Training dan Agent diblokir secara default pada halaman yang menampilkan iklan, sedangkan Search tetap diizinkan. Ini penting buat publisher karena policy bot sekarang makin dekat dengan kebutuhan monetisasi dan discoverability, bukan cuma urusan security.

Kenapa mixed-use crawler bikin policy jadi tricky?

Masalahnya, ada crawler yang punya lebih dari satu fungsi. Cloudflare juga mengubah cara memperlakukan multi-purpose crawler: keputusan mengikuti seluruh behavior yang terdeteksi, dan policy yang paling restrictive bisa menang. Jadi kalau kita asal block Training, kita perlu cek apakah crawler yang sama juga dipakai untuk Search supaya indexing nggak kena efek samping.

Disallow dan Block itu beda

Disallow lebih dekat ke pernyataan preference—misalnya lewat robots.txt atau mekanisme serupa. Block adalah enforcement di edge: request benar-benar dihentikan. Buat engineer, perbedaannya sederhana: kalau cuma bilang “tolong jangan dipakai untuk training”, itu belum tentu sama dengan benar-benar memblokir request.

Apa yang perlu dicek setelah policy diubah?

Jangan berhenti di dashboard. Cek robots.txt aktual, lihat traffic bot, pantau search indexing, dan kalau punya logging yang cukup, bandingkan request crawler sebelum dan sesudah perubahan. Kalau discoverability turun setelah policy baru aktif, review dulu klasifikasi dan behavior bot sebelum menyalahkan search engine.

Contoh alur review yang simpel

Mulai dari kebutuhan website: apakah harus tetap searchable, apakah agent boleh baca konten, dan apakah training boleh. Setelah itu baru tentukan policy per kategori, lalu verifikasi efeknya dari sisi traffic dan indexing.

Search      -> Allow
Agent       -> Review kebutuhan
Training    -> Disallow atau Block

Setelah perubahan:
1. Cek robots.txt
2. Cek bot traffic
3. Cek indexing
4. Review false positive

Apa artinya buat network & security engineer?

Bot management sekarang makin mirip policy berbasis intent. Pertanyaannya bukan cuma “ini bot atau bukan?”, tapi “bot ini datang buat apa?”. Itu berarti monitoring, logging, dan rule design harus ikut berkembang. Kalau semua automation dipukul rata, risiko false positive dan impact ke business bisa lebih besar.

Yang perlu diingat

Update ini bukan alasan buat langsung block semua AI traffic. Website dokumentasi, tutorial, atau publisher tetap punya kebutuhan discovery. Yang lebih masuk akal adalah pisahkan use case-nya, pilih policy sesuai tujuan, lalu ukur efeknya.

Sumber utama

Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training ↗Cloudflare Blog — Your site, your rules: new AI traffic options for all customers ↗Cloudflare Docs — Block AI bots / AI crawler controls ↗
Lihat semua News & Analysis →