robots.txt kurallarını Python ile test etmek
Bir robots.txt değişikliğini canlıya almadan önce "şu URL'ler hâlâ taranabilir mi?" sorusunu tek tek tarayıcıda denemek zahmetli. Python'un standart kütüphanesinde bunun için hazır bir modül var.
Dikkat: her ayrıştırıcı aynı değil
Python'un modülü eski taslağa göre çalışıyor ve iki noktada Google'dan farklı:
- Joker karakterler (
*,$): Python bunları desteklemiyor. Yukarıdaki/*?sirala=kuralı Python'da işe yaramaz ama Google'da çalışır. - Allow/Disallow önceliği: Google en uzun (en özel) kuralı seçer. Python ise ilk eşleşeni alır.
Yani Python ile basit kuralları hızlıca test edebilirsin. Joker karakter kullanıyorsan Google'ın açık kaynak ayrıştırıcısı ya da Search Console'daki robots.txt raporu daha güvenilir.
Canlı dosyayı test etmek
rp = RobotFileParser("https://johnflaxman.com/robots.txt")
rp.read()
print(rp.can_fetch("*", "https://johnflaxman.com/search?q=test"))Comments / questions
There's no comment section here. If you have a question or want to add something, message me on Telegram or send an email to [email protected]. Thanks!
Related pages
- robots.txt dosyasına yorum yazmak: tarayıcılar neyi görmezden gelir? (2025)
- hreflang hatalarını Python ile denetlemek (2025)
- CMS taşımasından sonra kaybolan URL'leri curl ile bulmak (2026)
- Bir sitenin iç bağlantı sayılarını komut satırından çıkarmak (2025)
- Search Console API ile tüm sorguları CSV'ye indirmek (2024)