Votre fichier robots.txt interdit à Google d'explorer cette URL. Piège classique : bloquer l'exploration n'empêche pas toujours l'indexation. Google peut afficher l'adresse sans en connaître le contenu.
Une règle Disallow couvre la page, Google ne la lit pas. C'est le bon outil pour économiser de l'exploration sur des URLs inutiles, le mauvais pour empêcher une page d'apparaître dans les résultats.
Si d'autres sites lient cette URL, Google peut l'indexer sans son contenu, avec un titre vide et une description absente. Pour vraiment la sortir des résultats, il faut un noindex, donc laisser Google explorer la page.
L'agent croise les URLs bloquées avec leurs impressions : si une page bloquée génère quand même des affichages, il vous le montre pour trancher entre Disallow et noindex.
Quand utiliser le robots.txt plutôt qu'un noindex ?
Robots.txt pour économiser l'exploration sur des zones sans valeur (panier, recherche interne, paramètres). Noindex pour tenir une page hors des résultats. Confondre les deux fait ranker des URLs vides ou gaspille votre exploration.
Une page bloquée qui reçoit des impressions, faut-il s'en inquiéter ?
Oui : elle apparaît dans les résultats sans contenu lisible, donc avec un titre vide, ce qui abîme votre image dans les SERP. Débloquez l'exploration et posez un noindex si vous ne la voulez pas indexée.
Sur un gros site, bloquer les facettes au robots.txt améliore-t-il l'indexation du reste ?
Oui, c'est un des leviers les plus directs. En empêchant Google de perdre son temps sur des milliers d'URLs à facettes, vous réallouez son exploration à vos pages qui comptent.
Vous voyez vos pages réellement dans cet état, avec leurs impressions, en 2 minutes.
Google Search Console Help, rapport « Indexation des pages » définition officielle de l'état « URL bloquée par le fichier robots.txt »