Générateur de sitemap XML

Collez vos adresses — d’un tableur, de la console, peu importe — et obtenez un fichier que les moteurs accepteront. Les doublons et les lignes parasites sont signalés, pas écartés en silence.

Google lit lastmod et ignore changefreq et priority — ils restent ici pour les autres robots.

Comment faire

  1. Collez la liste d’adresses, une par ligne ; les chemins relatifs marchent si vous renseignez l’adresse du site.
  2. Indiquez la date de modification si vous l’avez — Google lit ce champ.
  3. Copiez le XML ou téléchargez sitemap.xml et déposez-le à la racine du site.
  4. Pour vérifier un fichier existant, passez à Vérifier et collez-le.

Bon à savoir

L’esperluette qui casse tout le fichier

Une adresse avec paramètres — /?a=1&b=2 — n’a rien d’exceptionnel, mais en XML l’esperluette doit être échappée en &. Sans cela l’analyseur échoue à la première ligne de ce genre et rejette le fichier entier, pas seulement cette entrée. Cet outil échappe chaque adresse qu’il écrit : une chaîne de requête ne vous coûtera jamais le sitemap.

Ce que Google lit vraiment

Des quatre champs, seul lastmod est utilisé, et seulement s’il est honnête : une date qui change à chaque déploiement apprend au robot à l’ignorer. Changefreq et priority sont ignorés par Google depuis des années ; ils restent ici parce que d’autres robots et certains outils internes les lisent encore, mais n’attendez d’eux aucun effet sur le classement.

Questions fréquentes

Combien d’adresses tiennent dans un fichier ?

Cinquante mille, et pas plus de cinquante mégaoctets non compressés. Au-delà, on découpe la liste en plusieurs fichiers que l’on énumère dans un index de sitemaps. Le vérificateur prévient quand un fichier collé dépasse la limite.

Quelles pages ne doivent pas figurer dans le sitemap ?

Tout ce que vous ne voudriez pas voir comme résultat : pages fermées par robots.txt ou noindex, doublons dont la canonique pointe ailleurs, redirections et pages d’erreur. Un sitemap plein de telles adresses réduit la confiance accordée au fichier entier.

Où placer le fichier terminé ?

À la racine du site, à côté de robots.txt, et ajoutez dans robots.txt la ligne « Sitemap: https://example.com/sitemap.xml ». L’envoi dans la Search Console reste facultatif ensuite, mais il accélère la première exploration.

Puis-je explorer mon site avec cet outil ?

Non, et aucun outil de navigateur ne le peut honnêtement : pour des raisons de sécurité, une page d’un autre domaine ne se lit pas depuis un script. Cet outil construit le fichier à partir de la liste que vous fournissez ; cette liste vient de votre CMS, de votre build ou d’un crawler de bureau.

Outils similaires