Ce que vérifie cet outil
Récupère /sitemap.xml à la racine du domaine, détecte s'il s'agit d'un sitemap classique (<urlset>, listant directement des URLs de pages) ou d'un index de sitemaps (<sitemapindex>, listant d'autres fichiers sitemap — utilisé par les grands sites répartis sur plusieurs fichiers), compte le nombre total d'entrées <loc>, et vérifie un échantillon représentatif de 10 d'entre elles pour voir si elles répondent encore avec un statut fonctionnel.
Pourquoi « trouvé : non » n'est pas forcément mauvais signe
Tous les sites n'ont pas besoin d'un sitemap pour être bien indexés — un petit site avec une structure de liens internes claire peut être entièrement découvert par les moteurs de recherche sans en avoir un. Un sitemap manquant est un signal à connaître, surtout pour les sites plus grands ou fréquemment mis à jour où cela accélère nettement la découverte de nouveau contenu, mais ce n'est pas en soi un état cassé.
Pourquoi l'échantillon est réparti uniformément plutôt que de prendre les 10 premiers
Les sitemaps sont souvent générés dans un ordre stable (par exemple, contenu le plus ancien en premier, ou par ordre alphabétique) — ne vérifier que les 10 premières entrées manquerait systématiquement des problèmes concentrés plus loin dans la liste, comme un lot de pages d'une période donnée devenues cassées depuis. Répartir l'échantillon sur toute la liste donne un signal bien plus représentatif pour le même nombre de requêtes.