Audit SEO : la checklist complète 2025
Votre site peut être beau, rapide et riche en contenu — si Google ne le lit pas correctement, il n'existe pas. L'audit SEO on-page consiste à vérifier méthodiquement tout ce qui conditionne la façon dont les moteurs de recherche découvrent, comprennent et classent vos pages. La bonne nouvelle : contrairement aux backlinks ou à la notoriété, tous ces points sont sous votre contrôle direct.
Voici la checklist complète, organisée par famille de contrôles.
Pourquoi auditer son SEO régulièrement ?
Un site web n'est jamais figé. Chaque mise à jour de CMS, chaque nouvelle page, chaque refonte partielle peut introduire une régression invisible : une balise title dupliquée, un noindex oublié après la mise en production, un sitemap qui ne se régénère plus. Ces erreurs ne produisent aucun symptôme visible — le site fonctionne normalement pour les visiteurs — mais elles érodent silencieusement votre positionnement.
Un audit trimestriel, ou après chaque évolution significative du site, permet de détecter ces régressions avant qu'elles ne coûtent des positions.
1. Les balises meta : la carte d'identité de chaque page
Title
La balise <title> est le facteur on-page le plus important. Pour chaque page, vérifiez :
- Présence : une page sans title est une page que Google titre à votre place.
- Unicité : deux pages avec le même title se cannibalisent. C'est l'erreur la plus fréquente sur les sites à gabarits (e-commerce, blogs).
- Longueur : visez 50–60 caractères. Au-delà, Google tronque ; en deçà de 20, vous gaspillez l'espace.
- Pertinence : le mot-clé principal en début de title, la marque en fin.
Meta description
Elle n'influence pas directement le classement, mais conditionne le taux de clic dans les résultats : c'est votre argumentaire commercial en 150–160 caractères. Absente ou dupliquée, Google improvise en piochant dans la page — rarement à votre avantage.
Viewport, charset, lang
Trois balises techniques souvent négligées :
viewport: sans elle, votre site est illisible sur mobile — et Google indexe d'abord la version mobile (mobile-first indexing).charset(UTF-8) : son absence peut provoquer des caractères corrompus dans les extraits.lang: indique la langue de la page aux moteurs et aux lecteurs d'écran. Un site français aveclang="en"envoie un signal contradictoire.
Comment corriger : titles et meta descriptions
WordPress
Installez Yoast SEO ou Rank Math : chaque page et article reçoit un champ title + meta description éditable. Pour les sites à gabarit, configurez les modèles (Réglages SEO → Apparence dans la recherche) avec des variables — %%title%% – %%sitename%% — pour générer des titles uniques sur toutes les pages d'archive et de taxonomie d'un coup.
SaaS
- Shopify : chaque produit/page/collection a une section « Référencement sur les moteurs de recherche » (titre + description) en bas de l'éditeur. Les fiches produits laissées au titre par défaut sont la cause n° 1 de titles dupliqués.
- Wix / Squarespace : panneau « SEO » de chaque page pour le titre et la description ; Wix propose aussi des modèles par type de page.
2. La structure des titres : H1 unique, hiérarchie logique
Les balises de titre (H1 à H6) donnent le plan de votre page :
- Un seul H1 par page, qui annonce le sujet principal. Zéro H1, c'est une page sans titre pour Google ; plusieurs H1, c'est un signal brouillé.
- Hiérarchie sans saut : un H3 ne doit pas suivre directement un H1. Les sauts de niveau dégradent la compréhension de la structure — par les moteurs comme par les lecteurs d'écran.
- Des titres descriptifs : « Nos services » informe moins que « Création de sites e-commerce à Lyon ».
C'est un point doublement payant : la même structure propre sert le SEO et l'accessibilité.
3. Le fichier robots.txt : le portier de votre site
Le robots.txt indique aux robots ce qu'ils peuvent explorer. L'audit vérifie :
- Présence et accessibilité : un robots.txt qui renvoie une erreur 500 peut bloquer toute l'exploration.
- Directives Disallow accidentelles : le classique
Disallow: /oublié après une mise en production bloque l'intégralité du site. Cela arrive plus souvent qu'on ne le croit. - Référence au sitemap : la ligne
Sitemap:aide les moteurs à trouver votre plan de site. - Cohérence : bloquer des ressources CSS/JS nécessaires au rendu empêche Google d'évaluer correctement vos pages.
Comment corriger : robots.txt
Sur un serveur classique (Apache, nginx), pas de configuration : c'est un simple fichier texte robots.txt déposé à la racine web. Cas particuliers :
WordPress
WordPress génère un robots.txt virtuel (le fichier n'existe pas sur le disque). Pour l'éditer : Yoast SEO → Outils → Éditeur de fichiers, ou Rank Math → Réglages généraux → Modifier le robots.txt. Vérifiez aussi Réglages → Lecture : la case « Demander aux moteurs de recherche de ne pas indexer ce site » cochée équivaut à un blocage global — c'est l'oubli classique après une mise en production.
SaaS
- Shopify : robots.txt généré automatiquement, personnalisable depuis 2021 via le template
robots.txt.liquid(Boutique en ligne → Thèmes → Modifier le code). - Wix / Squarespace : géré par la plateforme, éditable partiellement (Wix : Outils SEO → Éditeur robots.txt). En pratique, les valeurs par défaut conviennent.
4. Le sitemap XML : le plan remis à Google
Le sitemap liste les URLs que vous voulez voir indexées :
- Présence à l'emplacement standard (
/sitemap.xml) ou déclaré dans le robots.txt. - Fraîcheur : les dates
lastmoddoivent refléter les vraies mises à jour. Un sitemap figé depuis deux ans signale un site à l'abandon. - Cohérence : le sitemap ne doit contenir ni URLs en erreur 404, ni pages en
noindex, ni redirections — chaque entrée invalide gaspille votre budget d'exploration. - Exhaustivité : les pages importantes absentes du sitemap mettent plus de temps à être découvertes.
5. Indexabilité : noindex, canonical, redirections
Trois mécanismes contrôlent ce qui entre dans l'index :
- Meta robots
noindex: vérifiez qu'aucune page stratégique n'en porte un par accident — c'est l'erreur de mise en production la plus coûteuse qui soit. - Balise canonical : elle désigne la version « officielle » d'une page quand plusieurs URLs servent le même contenu (paramètres de tri, sessions, http/https, www/non-www). Une canonical absente disperse la valeur SEO ; une canonical incorrecte la transfère à la mauvaise page.
- Chaînes de redirections : chaque redirection ajoute de la latence et dilue le signal. Une URL ne devrait jamais traverser plus d'une redirection.
Comment corriger : poser des redirections 301 propres
Apache
Dans le .htaccess :
# Redirection permanente d'une URL précise
Redirect 301 /ancienne-page https://www.monsite.fr/nouvelle-page
# Forcer HTTPS + www en une seule redirection (pas de chaîne)
RewriteEngine On
RewriteCond %{HTTPS} off [OR]
RewriteCond %{HTTP_HOST} !^www\. [NC]
RewriteRule ^(.*)$ https://www.monsite.fr/$1 [R=301,L]
nginx
# Redirection permanente d'une URL précise
location = /ancienne-page {
return 301 https://www.monsite.fr/nouvelle-page;
}
# Forcer HTTPS : un bloc server dédié au port 80
server {
listen 80;
server_name monsite.fr www.monsite.fr;
return 301 https://www.monsite.fr$request_uri;
}
WordPress
Le plugin Redirection gère les 301 depuis l'admin et journalise les 404 rencontrées par les visiteurs — utile pour découvrir les liens cassés à rediriger. Les redirections HTTPS/www se font au niveau .htaccess (onglet Apache).
SaaS
- Shopify : Boutique en ligne → Navigation → Redirections d'URL (import CSV possible pour les migrations).
- Wix / Squarespace : Outils SEO → Gestionnaire de redirections 301. HTTPS et www sont gérés automatiquement par la plateforme.
6. Les données structurées JSON-LD : parler le langage de Google
Les données structurées décrivent explicitement votre contenu (produit, avis, FAQ, entreprise locale, article…) au format schema.org. Elles conditionnent l'affichage des résultats enrichis : étoiles d'avis, prix, disponibilité, FAQ dépliables directement dans Google.
L'audit vérifie :
- la présence de JSON-LD sur les pages qui s'y prêtent ;
- la validité syntaxique (un JSON malformé est ignoré silencieusement) ;
- la cohérence entre les données déclarées et le contenu visible — déclarer des avis inexistants expose à des pénalités manuelles.
À périmètre concurrentiel égal, le résultat enrichi capte le clic. C'est l'un des chantiers SEO au meilleur rapport effort/impact.
7. La qualité du contenu : ce que Google mesure réellement
Sans juger la pertinence éditoriale, un audit détecte les signaux mesurables de contenu faible :
- Longueur minimale : une page de 50 mots a très peu de chances de se positionner sur quoi que ce soit. Les pages « fantômes » (catégories vides, archives auto-générées) diluent la qualité globale perçue du site.
- Ratio texte/HTML : une page de 2 Mo de code pour trois phrases de contenu indique un déséquilibre.
- Contenu dupliqué interne : descriptions produits identiques, pages quasi-clones — Google choisit alors lui-même laquelle indexer, rarement la bonne.
- Images sans attribut alt : chaque image sans alternative textuelle est une occasion manquée de contexte sémantique (et un défaut d'accessibilité).
8. Maillage interne et liens
Les liens structurent la circulation de la valeur SEO dans votre site :
- Liens internes cassés : chaque 404 interne est une impasse pour les robots et une friction pour l'utilisateur.
- Pages orphelines : une page vers laquelle aucun lien interne ne pointe est quasi invisible pour Google, même présente dans le sitemap.
- Profondeur de clic : une page importante ne devrait pas être à plus de 3 clics de l'accueil.
- Liens externes : les liens sortants vers des sites disparus ou douteux dégradent le signal de qualité. Les attributs
nofollow/sponsoreddoivent être posés à bon escient. - Ancres descriptives : « cliquez ici » n'apprend rien à personne ; « consultez notre guide RGPD » oriente l'utilisateur et le moteur.
Tableau récapitulatif
| Famille | Points clés | Erreur typique |
|---|---|---|
| Balises meta | title unique, description, viewport, lang | Titles dupliqués sur les pages à gabarit |
| Structure Hn | H1 unique, hiérarchie sans saut | Plusieurs H1 injectés par le thème |
| robots.txt | accessible, pas de Disallow accidentel | Disallow: / oublié après mise en prod |
| Sitemap | présent, frais, sans URLs invalides | Sitemap non régénéré depuis des mois |
| Indexabilité | noindex, canonical, redirections | noindex de préproduction resté en ligne |
| Données structurées | JSON-LD présent et valide | JSON malformé ignoré silencieusement |
| Contenu | longueur, duplication, alt | Pages catégories quasi vides |
| Maillage | liens cassés, orphelines, profondeur | 404 internes accumulées au fil des refontes |
Passez la checklist en quelques minutes
Vérifier ces points à la main sur un site de 50 pages représente une journée de travail minutieux — et il faudra recommencer au prochain trimestre. FlashScanr analyse l'ensemble de ces contrôles sur toutes vos pages en quelques minutes et vous remet un rapport priorisé : ce qui bloque l'indexation d'abord, les optimisations ensuite.