Le message « impossible de récupérer le sitemap » ne dit pas ce qui ne va pas. C'est un constat d'échec, pas un diagnostic, et six causes très différentes le produisent.
Avant d'en modifier une seule, faites le test qui les départage : ouvrez l'adresse de votre sitemap vous-même, depuis une fenêtre de navigation privée, comme un visiteur qui ne serait jamais venu. Ce que vous voyez à cet instant élimine la moitié des hypothèses.
Cause 1 : l'adresse ne répond pas vraiment 200
La plus fréquente, et la plus invisible depuis votre poste.
Une redirection compte comme un échec à cet endroit. Si vous avez déclaré votre sitemap sur une adresse qui redirige vers une autre, avec ou sans www, en http plutôt qu'en https, ou vers une version localisée, vous avez déclaré une adresse qui ne sert pas le fichier. Une page d'erreur renvoyée avec un code 200 est le même piège inversé : le serveur dit que tout va bien et envoie du HTML d'excuse.
Le test : l'adresse exacte que vous avez soumise, au caractère près, doit renvoyer le fichier directement, sans étape intermédiaire.
Cause 2 : le sitemap répond, mais il est vide
Celle-là ne se voit pas du tout, parce que tout a l'air de fonctionner.
Un sitemap qui liste vos pages fixes mais aucun de vos articles est presque toujours le symptôme d'une erreur avalée. Le code demande la liste des contenus publiés, la requête échoue, personne ne lit le message d'erreur, et le fichier se génère quand même avec ce qu'il restait. Nous avons eu exactement ce cas ici : la seule différence entre un sitemap complet et un sitemap amputé était une erreur que rien n'affichait.
Le test : comptez les adresses dans le fichier, et comparez avec ce que vous publiez réellement. Un écart est un bug, jamais une coïncidence.
Cause 3 : la propriété déclarée n'est pas celle des adresses
Search Console vérifie que les adresses contenues dans le sitemap appartiennent bien à la propriété où vous le soumettez.
Si votre propriété est déclarée avec www et que vos adresses n'en ont pas, ou l'inverse, le fichier est refusé même s'il est parfaitement valide. Même chose entre http et https. C'est une cause de rejet fréquente sur les sites qui ont changé de domaine ou forcé le chiffrement après coup.
Le test : ouvrez le fichier et comparez la première adresse listée avec le nom exact de votre propriété. Ils doivent coïncider caractère pour caractère.
Cause 4 : votre robots.txt bloque ce que vous soumettez
Deux variantes, avec deux conséquences distinctes.
Soit le chemin du sitemap lui-même est interdit, et il ne peut pas être lu. Soit les adresses qu'il contient sont interdites, et il est lu mais son contenu est inexploitable. Le second cas est le plus déroutant, parce que le fichier se charge très bien quand vous l'ouvrez vous-même.
Profitez-en pour vérifier que votre robots.txt déclare l'adresse de votre sitemap. Ce n'est pas obligatoire, mais c'est la manière la plus simple de la rendre trouvable sans la soumettre nulle part.
Cause 5 : le sitemap liste des pages que vous demandez d'ignorer
Un sitemap est une liste de pages que vous voulez voir indexées. Y faire figurer une page marquée en noindex est une contradiction, et elle vous est signalée.
Les coupables habituels sont toujours les mêmes : une page de connexion, une page de remerciement après formulaire, une prévisualisation de brouillon. Elles n'ont rien à faire dans le fichier, précisément parce qu'elles font correctement leur travail ailleurs.
Un sitemap est une liste de pages que vous voulez indexées. Tout ce qui n'est pas dans ce cas n'a rien à y faire.
Cause 6 : ce n'est pas du XML
Un sitemap doit commencer par une déclaration XML, et rien ne doit la précéder. Pas une ligne vide, pas un caractère invisible ajouté par un éditeur, pas un avertissement du serveur.
Le test : regardez les tout premiers caractères du fichier. S'ils ne sont pas la déclaration XML, vous avez trouvé. Cette cause se produit surtout quand le sitemap est généré à la main ou par une extension plutôt que par le site lui-même.
Ce que le message ne veut pas dire
Il ne veut pas dire que votre site est pénalisé. Il ne veut pas dire non plus que vos pages ne seront pas indexées : un sitemap facilite la découverte, il ne la conditionne pas. Un site correctement lié en interne se fait trouver sans lui.
Cette nuance a son importance, parce qu'elle évite deux erreurs opposées : paniquer sur un message qui n'est pas grave, et croire qu'un sitemap réparé suffit à régler un problème de visibilité. Si vos pages n'ont aucun lien entrant depuis le reste du site, le sitemap ne compensera rien.
Une fois corrigé
Soumettez une fois, et laissez faire. Renvoyer le fichier dix fois dans la journée n'apporte rien et vous prive du seul signal utile, qui est de voir l'état changer tout seul.
Profitez de l'attente pour vérifier ce qui compte davantage : que chaque page listée soit réellement atteignable depuis une autre page du site. Une page présente dans le sitemap et liée depuis nulle part est une page orpheline, et le sitemap ne la sauvera pas.
Ce qu'il faut en retenir
Le sitemap est souvent innocent. Dans notre propre cas, le fichier était parfaitement valide et le vrai problème était ailleurs : un contenu absent de la base, donc absent du site, donc absent du fichier. Chercher l'erreur dans le sitemap aurait pu durer longtemps.
Commencez donc par regarder le fichier de vos propres yeux, puis remontez la chaîne. C'est le même réflexe que celui décrit dans notre article sur la citation par ChatGPT et Perplexity : ce qui compte est ce que la machine reçoit, pas ce que vous croyez lui envoyer. Si vous préférez qu'on regarde avec vous, écrivez-nous, et si le sujet est plus large que ce fichier, notre approche du développement vous dira comment nous le traitons.




