Exploration et Search Console
L’aperçu des biens immobiliers de WP-ImmoMakler est accessible sous plus d’adresses qu’il n’en faudrait dans l’index d’un moteur de recherche : liens de tri, adresses de retour du défilement infini, cadre de la carte. Ces adresses sont destinées au navigateur de vos visiteurs. Pour les moteurs de recherche, ce sont des copies d’une page qu’ils connaissent déjà — et dans la Google Search Console, elles apparaissent comme des entrées qui ne disent rien sur la facilité à trouver vos biens immobiliers.
Cet article décrit quelles sont ces adresses, comment WP-ImmoMakler les gère et quelle condition votre serveur doit remplir pour cela.
Quelles adresses sont concernées
Section intitulée « Quelles adresses sont concernées »| Adresse | Objet | Exemple |
|---|---|---|
?im_order=… | Liens de tri de l’aperçu des biens immobiliers | /immobilien/?im_order=priceasc |
/page/12/loadall/ | Lien de retour « Retour à l’aperçu » sous le défilement infini : charge les pages 1 à 12 en une fois, afin que les visiteurs puissent continuer à lire à l’endroit où ils ont ouvert un bien | /immobilien/page/12/loadall/ |
?callback=map-iframe | Le cadre dans lequel se charge la carte d’un bien ou de l’aperçu | /immobilien/haus-am-see/?callback=map-iframe&immomakler_map_frame=map-1 |
Chacune de ces adresses porte déjà un signal qui indique la bonne voie aux moteurs de recherche : les liens de tri sont marqués rel="nofollow" ; avec un plugin SEO comme Yoast SEO ou Rank Math, ceux-ci ainsi que les pages /loadall/ pointent en plus vers la page habituelle via une balise canonique. Le cadre de la carte redirige une requête sans page d’origine — c’est ainsi qu’arrive un robot d’exploration — vers l’aperçu des biens immobiliers via un HTTP 301. Le cadre lui-même envoie en outre X-Robots-Tag: noindex, nofollow.
Un moteur de recherche ne lit tous ces signaux qu’après avoir récupéré l’adresse. La récupération elle-même a donc quand même lieu — et c’est précisément elle qui apparaît dans la Search Console.
Comment WP-ImmoMakler tient les moteurs de recherche à l’écart
Section intitulée « Comment WP-ImmoMakler tient les moteurs de recherche à l’écart »WP-ImmoMakler ajoute au robots.txt de votre site un groupe de règles propre qui empêche d’emblée la récupération de ces adresses :
User-agent: *Disallow: /*callback=map-iframeDisallow: /*im_order=Disallow: /*/loadall/Les règles s’appliquent à tous les robots d’exploration qui comprennent le caractère générique * — Google, Bing et les autres grands moteurs de recherche. Rien ne change pour vos visiteurs : le navigateur charge toujours le cadre de la carte, le tri et le lien de retour comme auparavant.
Condition requise : WordPress doit fournir le robots.txt
Section intitulée « Condition requise : WordPress doit fournir le robots.txt »WordPress génère le robots.txt de façon dynamique — il n’existe aucun fichier sur le serveur qui réponde à la requête vers /robots.txt ; c’est WordPress lui-même qui le fait. C’est seulement ainsi que des plugins comme WP-ImmoMakler ou votre plugin SEO peuvent ajouter leurs règles. Deux configurations annulent cela :
- Le serveur web répond lui-même à la requête. Certaines configurations nginx ou Apache traitent
/robots.txtcomme un fichier statique et renvoient une erreur 404 si aucun n’existe. La requête n’atteint alors jamais WordPress — dans ce cas, votre site n’a aucunrobots.txt, pas même celui de WordPress et de votre plugin SEO. - Un véritable fichier
robots.txtse trouve dans le répertoire racine. Le serveur web le fournit directement, sans interroger WordPress. Les règles de WP-ImmoMakler manquent alors, tout comme celles de votre plugin SEO.
Voici comment vérifier l’état de votre site :
curl -I https://votre-site.fr/robots.txtSi le serveur répond avec HTTP/2 200 et content-type: text/plain, tout est en ordre. Ouvrez également l’adresse dans le navigateur : si le résultat contient la ligne Disallow: /*im_order=, elle provient de WordPress et les règles de WP-ImmoMakler sont actives.
Si le serveur répond avec 404, la configuration 1 s’applique. Demandez à votre hébergeur de transmettre à WordPress les requêtes vers /robots.txt — sous nginx, typiquement via try_files $uri /index.php?$args; pour ce chemin. Si la ligne manque dans le résultat bien que le serveur réponde avec 200, la configuration 2 s’applique : ajoutez à la main les trois lignes Disallow de la section ci-dessus dans votre fichier, ou supprimez le fichier pour que WordPress génère de nouveau le robots.txt.
À quoi s’attendre dans la Search Console
Section intitulée « À quoi s’attendre dans la Search Console »Après le changement, les adresses concernées passent dans la Search Console dans la zone Bloquée par le fichier robots.txt. C’est l’état souhaité : Google ne mentionne les adresses à cet endroit que parce qu’il les connaît encore d’explorations précédentes, et ne les récupère plus. La zone se vide d’elle-même en quelques semaines.
Les adresses provenant de versions antérieures de WP-ImmoMakler, où des numéros de page s’étaient enchaînés — par exemple /immobilien/page/7/page/5/ —, WP-ImmoMakler les redirige via un HTTP 301 vers la page visée, ici /immobilien/page/5/. Dans la Search Console, elles apparaissent alors comme Page avec redirection au lieu d’une erreur 404, et disparaissent également d’elles-mêmes.
Trois rapports, en revanche, ne sont pas préoccupants, même s’ils affichent de nombreuses entrées :
- Autre page avec balise canonique appropriée — Google a récupéré une adresse dont la balise canonique pointe vers une autre page, et a suivi la recommandation.
- Page avec redirection — Google a récupéré une adresse qui redirige via 301, et a adopté l’adresse de destination.
- Bloquée par le fichier robots.txt — voir ci-dessus.
Une entrée dans ces rapports ne signifie pas qu’un de vos biens est plus difficile à trouver. Seuls les rapports dans lesquels figure une page de détail d’un bien ou l’aperçu lui-même sont critiques — par exemple Introuvable (404) pour un bien encore proposé.