Ce qu’est un audit SEO technique
Un audit SEO technique répond à une question : la bonne page peut-elle être découverte, récupérée, indexée, comprise et réutilisée, par les moteurs de recherche et par les moteurs de réponse par IA. Tout le reste d’un programme de SEO ou d’optimisation pour les moteurs de réponse repose sur ce oui. La qualité du contenu, les backlinks et un positionnement brillant ne valent rien pour une page que les crawlers n’ont jamais lue avec succès.
Voici ce que vous pouvez réellement faire depuis cette page, énoncé clairement. Le scan gratuit de visibilité dans l’IA est un vrai audit technique en direct limité à une page : saisissez un domaine sans inscription, et il récupère votre page d’accueil, robots.txt et llms.txt, découvre votre sitemap, vérifie l’accès du robots.txt pour 16 user agents de crawlers d’IA, et vérifie l’indexabilité, les balises canoniques, les données structurées JSON-LD, la structure du H1, la santé du titre et de la description méta, et les balises Open Graph. Il renvoie un score de 0 à 100 et une liste de problèmes classés. La version à l’échelle du site, qui explore chaque page interne et se relance selon un calendrier, est la fonctionnalité d’audit dans l’app.
Les quatre étapes qu’une page doit passer
Le SEO technique cesse d’être une checklist de 200 points dès que vous le voyez comme quatre étapes séquentielles. Une page qui échoue à l’étape un n’est jamais jugée à l’étape quatre.
Étape 1 : Récupération. Le serveur doit renvoyer la page. Les délais d’expiration, les erreurs 5xx, les règles de WAF et de CDN qui défient les bots, et les chaînes de redirection qui ne se résolvent jamais échouent tous à cette étape. Les crawlers d’IA y échouent de façon disproportionnée, car les préréglages de protection contre les bots bloquent fréquemment leurs user agents par défaut tout en laissant Googlebot tranquille.
Étape 2 : Permission d’exploration. robots.txt décide qui peut récupérer quoi. Un seul Disallow: / inattentif sur un modèle, ou une règle globale copiée de la préproduction, retire des sections entières de la portée de chaque crawler. Le guide robots.txt couvre les règles et les user agents des crawlers d’IA en détail.
Étape 3 : Éligibilité à l’indexation. Une page récupérée a encore besoin de la permission d’être stockée et servie : aucune directive noindex égarée, une balise canonique qui pointe là où vous l’entendez, et aucun cluster de doublons qui embrouille l’URL réelle. La blessure auto-infligée classique vit ici : une balise méta noindex livrée de la préproduction à la production.
Étape 4 : Extraction. La page doit être compréhensible. Un JSON-LD valide qui correspond au contenu visible, un seul H1 clair, des titres qui délimitent les sections, et des réponses énoncées dans une prose extractible plutôt qu’enterrées dans des widgets rendus côté client. Cette étape comptait à peine il y a une décennie ; pour les moteurs de réponse, elle est décisive, car ils citent des passages, pas des pages.
Comment lire les constats d’audit
| Constat | Étape | Degré d’urgence |
|---|---|---|
| Erreurs serveur, redirections irrésolubles | Récupération | Immédiat : la page n’existe pas pour les crawlers |
| Crawlers d’IA bloqués dans robots.txt | Exploration | Immédiat si vous voulez la visibilité dans les réponses de l’IA ; politique délibérée sinon |
| Noindex accidentel, canoniques en conflit | Indexation | Immédiat : du contenu éligible est jeté |
| Chaînes de redirection | Récupération et Indexation | Élevé : chaque saut gaspille du budget d’exploration et dilue les signaux |
| Liens internes brisés | Exploration | Élevé : ils fuient les chemins de découverte et la confiance des utilisateurs |
| Titres et métas dupliqués ou manquants | Extraction | Moyen : corrigez par lots par modèle |
| JSON-LD malformé ou manquant | Extraction | Moyen-élevé pour l’AEO : le schéma est la façon dont les moteurs résolvent les entités |
| Pages lentes (LCP) | Récupération et expérience utilisateur | Moyen : corrigez d’abord les pires |
| Aucune structure question-réponse | Extraction | Le constat spécifique à l’AEO : la page est lisible mais pas citable |
Deux règles d’interprétation. D’abord, la gravité est positionnelle : un problème moyen sur votre modèle qui convertit le mieux prime sur un problème critique sur une page de tag oubliée. Pondérez les constats par le trafic et le chiffre d’affaires des pages concernées. Ensuite, comptez les problèmes par cause racine, pas par instance : cinq mille avertissements de titre dupliqué sont généralement un seul bug de modèle, ce qui signifie un ticket, pas cinq mille.
Règles de décision pour traiter le backlog
- N’auditez jamais sans corriger. Un audit qui finit en PDF est une tactique dilatoire. Chaque constat devrait devenir un ticket détenu ; l’audit intégré pousse les constats directement vers un tableau de tickets pour exactement cette raison.
- Travaillez les étapes dans l’ordre. Les corrections de récupération et d’exploration d’abord, les corrections d’indexation ensuite, les corrections d’extraction en troisième. Optimiser le schéma sur une page que les crawlers d’IA ne peuvent pas récupérer, c’est astiquer les meubles dans une maison verrouillée.
- Corrigez les modèles, pas les pages. La plupart de la dette technique est générée par des modèles. Une correction de modèle répare des milliers d’URL à la fois.
- Relancez après chaque lot de corrections. Le scan gratuit est répétable à la demande, et l’audit intégré tourne chaque semaine ou chaque mois. Un constat n’est pas corrigé tant qu’une relance ne cesse pas de le signaler.
- Guettez les régressions, pas seulement les corrections. La prise la plus précieuse de l’audit, c’est le nouveau problème apparu après le déploiement de mardi, tant qu’il affecte des jours de trafic au lieu de mois.
Erreurs courantes
- Auditer une fois par an. La santé technique se dégrade à chaque mise en production. Les audits annuels documentent les dégâts ; les audits planifiés les préviennent.
- Faire confiance aux vérifications SEO en ignorant l’accès de l’IA. Un site peut être impeccable pour Googlebot et invisible pour GPTBot, PerplexityBot et ClaudeBot parce qu’un préréglage de pare-feu les a bloqués. Les outils d’audit classiques vérifient rarement cela ; le scan gratuit le vérifie en premier.
- Bloquer une page que vous voulez désindexer. Pour retirer une page indexée, les crawlers doivent pouvoir récupérer la directive noindex. Bloquer l’URL dans robots.txt préserve la fiche obsolète au lieu de la retirer.
- Un schéma qui contredit la page. Des données structurées décrivant un contenu qui n’est pas visiblement là sont un risque de crédibilité. Validez face à ce que voient les utilisateurs ; voyez l’entrée de glossaire sur les données structurées.
- Supposer que le contenu JavaScript est lu. Certains crawlers rendent le JavaScript, beaucoup de crawlers d’IA ne le font effectivement pas. Le contenu qui n’existe qu’après un rendu côté client leur est invisible. Rendez côté serveur tout ce que vous voulez voir cité.
Scan gratuit face à l’audit complet : la frontière honnête
Le scan gratuit suffit pour répondre à « ce domaine est-il fondamentalement ouvert aux affaires avec les moteurs de recherche et d’IA ? ». Il lit une page plus les fichiers d’accès, et comme ces fichiers sont à l’échelle du site, un constat sur robots.txt ou llms.txt s’applique à tout votre domaine. Lancez-le avant et après chaque mise en production significative ; il ne coûte rien.
Il ne suffit pas pour une assurance à l’échelle du site. Il ne peut pas trouver les liens brisés de la page 40, la chaîne de redirection dans vos archives de blog, ou le modèle qui a perdu son schéma FAQ le mois dernier. C’est l’audit intégré : le crawler de site suit les liens internes à travers le site (en respectant robots.txt et noindex, avec une profondeur et un rendu JavaScript configurables), la plupart des sites de moins de mille pages terminent en quelques minutes, et chaque page est vérifiée et notée pour la citabilité par le quality gate. Les constats atterrissent dans une seule file priorisée aux côtés de vos manques de suivi des citations dans l’IA, ce qui est tout l’intérêt de l’agent AEO Goal : trouver le manque, livrer la correction concrète, revérifier qu’elle a fonctionné. Pour une checklist manuelle à traiter en attendant, la checklist de SEO technique est gratuite.