meta robots et X-Robots-Tag : lequel Google applique
La balise meta robots vaut pour le HTML. L’en-tête X-Robots-Tag vaut pour tout fichier. En cas de conflit, la directive la plus restrictive l’emporte.
Tous les articles SiteGarde sur SEO Technique pour prioriser les bons contrôles.
42 articles correspondants aux filtres actifs
La balise meta robots vaut pour le HTML. L’en-tête X-Robots-Tag vaut pour tout fichier. En cas de conflit, la directive la plus restrictive l’emporte.
Quand Search Console indique qu’une URL est bloquée par robots.txt : lire le bon groupe User-agent, corriger le Disallow, et ne pas confondre avec noindex.
Un sitemap image associe des fichiers image à une page. Ce n’est pas le sitemap des URL. Format, limite de 1 000 images, et cas où il sert vraiment.
Un sitemap XML est limité à 50 Mo non compressés et 50 000 URL. Au-delà, découpez-le et publiez un index de sitemaps que Google peut lire.
Comment repérer les pages à plus de trois clics et leur ajouter des liens HTML depuis des pages déjà explorées par Google.
Une page orpheline n’a aucun lien interne entrant. On la trouve en croisant un crawl et le sitemap, puis on la relie depuis une page proche déjà indexée.
Google n’utilise plus rel=next et rel=prev. Chaque page de liste a sa propre URL, un titre distinct, un canonique vers elle-même et des liens explorables.
Quand utiliser fr, fr-FR ou fr-CA : une page française unique, ou deux versions France et Canada avec des URL distinctes.
Erreurs hreflang qui font ignorer le balisage : codes HTTP, lien manquant vers soi, x-default et conflit avec la canonical.