Derniers Articles
Pourquoi les IA de recherche génèrent-elles toujours les mêmes résultats ? La solution de Google ! SEO TikTok : comment apparaître dans les recherches de 30,6 millions de Français Comment les agents IA transforment le modèle de l’agence SEO (sans remplacer les consultants) L’État publie son premier guide officiel d’usage de l’IA pour ses agents Google punit-il les sites qui utilisent l’IA ? Notre avis sur le sujet Goossips SEO : Positionnement Infopro Digital Media dévoile son offre GEO pour positionner les marques au cœur des IA génératives L’édition de septembre 2026 de Réacteur est arrivée ! Google Analytics se dote enfin de vrais dashboards personnalisables AI Overviews en France : le replay, les slides et les réponses aux 187 questions du webinarLire l'article complet : Goossips SEO : Robots.txt
Publié le 28/07/2026 à 06:22:59 par Abondance
Goossips SEO : Robots.txt
Robots.txt : pourquoi Google peut ignorer vos règles de blocage
Un utilisateur Reddit gérait un client Shopify dont la barre de recherche interne se faisait exploiter par du spam : des requêtes de spammeurs généraient des URLs de résultats de recherche pointant vers des sites tiers. Le client avait bloqué /search via disallow dans le robots.txt, mais Google continuait d'indexer ces pages malgré tout.
John Mueller a examiné le fichier robots.txt du site en question et identifié la cause : le fichier contenait à la fois une section user-agent: Googlebot et une section user-agent: * (pour tous les robots), avec des règles différentes dans chacune.
Le point clé qu’il met en exergue : avec le robots.txt, la règle la plus spécifique l'emporte toujours. Si un fichier contient une section dédiée à Googlebot, ce dernier n'appliquera que les règles de cette section précise, il ignorera complètement celles définies sous user-agent: *, même si elles semblaient censées s'appliquer à tous les robots, Googlebot inclus.
John Mueller propose une solution pratique : si on veut appliquer les mêmes règles à plusieurs user-agents, il faut soit dupliquer les règles dans chaque section, soit lister tous les user-agents concernés ensemble au-dessus d'un même bloc de règles partagées.
Source : Search Engine Journal
Taux de fiabilité : 

On est d'accord !
Comme rappelé dans l’article de Search Engine Journal, le fichier robots.txt ne contrôle pas le crawl, mais l’indexation, d’où l’intérêt d’utiliser plutôt une directive noindex.
L’article "Goossips SEO : Robots.txt" a été publié sur le site Abondance.