// Tool

Audit SEO technique

Lancez une vérification technique gratuite de l'explorabilité, de l'indexabilité, des données structurées et de l'accès des crawlers d'IA, puis apprenez à lire et agir sur chaque constat.

Ce qu’est un audit SEO technique

Un audit SEO technique répond à une question : la bonne page peut-elle être découverte, récupérée, indexée, comprise et réutilisée, par les moteurs de recherche et par les moteurs de réponse par IA. Tout le reste d’un programme de SEO ou d’optimisation pour les moteurs de réponse repose sur ce oui. La qualité du contenu, les backlinks et un positionnement brillant ne valent rien pour une page que les crawlers n’ont jamais lue avec succès.

Voici ce que vous pouvez réellement faire depuis cette page, énoncé clairement. Le scan gratuit de visibilité dans l’IA est un vrai audit technique en direct limité à une page : saisissez un domaine sans inscription, et il récupère votre page d’accueil, robots.txt et llms.txt, découvre votre sitemap, vérifie l’accès du robots.txt pour 16 user agents de crawlers d’IA, et vérifie l’indexabilité, les balises canoniques, les données structurées JSON-LD, la structure du H1, la santé du titre et de la description méta, et les balises Open Graph. Il renvoie un score de 0 à 100 et une liste de problèmes classés. La version à l’échelle du site, qui explore chaque page interne et se relance selon un calendrier, est la fonctionnalité d’audit dans l’app.

Les quatre étapes qu’une page doit passer

Le SEO technique cesse d’être une checklist de 200 points dès que vous le voyez comme quatre étapes séquentielles. Une page qui échoue à l’étape un n’est jamais jugée à l’étape quatre.

Les quatre étapes techniques entre une page et la visibilité : récupération, permission d’exploration, éligibilité à l’indexation et extraction. Un échec à n’importe quelle étape retire la page à la fois des résultats de recherche et des réponses de l’IA, quelle que soit la qualité du contenu

Étape 1 : Récupération. Le serveur doit renvoyer la page. Les délais d’expiration, les erreurs 5xx, les règles de WAF et de CDN qui défient les bots, et les chaînes de redirection qui ne se résolvent jamais échouent tous à cette étape. Les crawlers d’IA y échouent de façon disproportionnée, car les préréglages de protection contre les bots bloquent fréquemment leurs user agents par défaut tout en laissant Googlebot tranquille.

Étape 2 : Permission d’exploration. robots.txt décide qui peut récupérer quoi. Un seul Disallow: / inattentif sur un modèle, ou une règle globale copiée de la préproduction, retire des sections entières de la portée de chaque crawler. Le guide robots.txt couvre les règles et les user agents des crawlers d’IA en détail.

Étape 3 : Éligibilité à l’indexation. Une page récupérée a encore besoin de la permission d’être stockée et servie : aucune directive noindex égarée, une balise canonique qui pointe là où vous l’entendez, et aucun cluster de doublons qui embrouille l’URL réelle. La blessure auto-infligée classique vit ici : une balise méta noindex livrée de la préproduction à la production.

Étape 4 : Extraction. La page doit être compréhensible. Un JSON-LD valide qui correspond au contenu visible, un seul H1 clair, des titres qui délimitent les sections, et des réponses énoncées dans une prose extractible plutôt qu’enterrées dans des widgets rendus côté client. Cette étape comptait à peine il y a une décennie ; pour les moteurs de réponse, elle est décisive, car ils citent des passages, pas des pages.

Comment lire les constats d’audit

Constat Étape Degré d’urgence
Erreurs serveur, redirections irrésolubles Récupération Immédiat : la page n’existe pas pour les crawlers
Crawlers d’IA bloqués dans robots.txt Exploration Immédiat si vous voulez la visibilité dans les réponses de l’IA ; politique délibérée sinon
Noindex accidentel, canoniques en conflit Indexation Immédiat : du contenu éligible est jeté
Chaînes de redirection Récupération et Indexation Élevé : chaque saut gaspille du budget d’exploration et dilue les signaux
Liens internes brisés Exploration Élevé : ils fuient les chemins de découverte et la confiance des utilisateurs
Titres et métas dupliqués ou manquants Extraction Moyen : corrigez par lots par modèle
JSON-LD malformé ou manquant Extraction Moyen-élevé pour l’AEO : le schéma est la façon dont les moteurs résolvent les entités
Pages lentes (LCP) Récupération et expérience utilisateur Moyen : corrigez d’abord les pires
Aucune structure question-réponse Extraction Le constat spécifique à l’AEO : la page est lisible mais pas citable

Deux règles d’interprétation. D’abord, la gravité est positionnelle : un problème moyen sur votre modèle qui convertit le mieux prime sur un problème critique sur une page de tag oubliée. Pondérez les constats par le trafic et le chiffre d’affaires des pages concernées. Ensuite, comptez les problèmes par cause racine, pas par instance : cinq mille avertissements de titre dupliqué sont généralement un seul bug de modèle, ce qui signifie un ticket, pas cinq mille.

Règles de décision pour traiter le backlog

  1. N’auditez jamais sans corriger. Un audit qui finit en PDF est une tactique dilatoire. Chaque constat devrait devenir un ticket détenu ; l’audit intégré pousse les constats directement vers un tableau de tickets pour exactement cette raison.
  2. Travaillez les étapes dans l’ordre. Les corrections de récupération et d’exploration d’abord, les corrections d’indexation ensuite, les corrections d’extraction en troisième. Optimiser le schéma sur une page que les crawlers d’IA ne peuvent pas récupérer, c’est astiquer les meubles dans une maison verrouillée.
  3. Corrigez les modèles, pas les pages. La plupart de la dette technique est générée par des modèles. Une correction de modèle répare des milliers d’URL à la fois.
  4. Relancez après chaque lot de corrections. Le scan gratuit est répétable à la demande, et l’audit intégré tourne chaque semaine ou chaque mois. Un constat n’est pas corrigé tant qu’une relance ne cesse pas de le signaler.
  5. Guettez les régressions, pas seulement les corrections. La prise la plus précieuse de l’audit, c’est le nouveau problème apparu après le déploiement de mardi, tant qu’il affecte des jours de trafic au lieu de mois.

Erreurs courantes

  • Auditer une fois par an. La santé technique se dégrade à chaque mise en production. Les audits annuels documentent les dégâts ; les audits planifiés les préviennent.
  • Faire confiance aux vérifications SEO en ignorant l’accès de l’IA. Un site peut être impeccable pour Googlebot et invisible pour GPTBot, PerplexityBot et ClaudeBot parce qu’un préréglage de pare-feu les a bloqués. Les outils d’audit classiques vérifient rarement cela ; le scan gratuit le vérifie en premier.
  • Bloquer une page que vous voulez désindexer. Pour retirer une page indexée, les crawlers doivent pouvoir récupérer la directive noindex. Bloquer l’URL dans robots.txt préserve la fiche obsolète au lieu de la retirer.
  • Un schéma qui contredit la page. Des données structurées décrivant un contenu qui n’est pas visiblement là sont un risque de crédibilité. Validez face à ce que voient les utilisateurs ; voyez l’entrée de glossaire sur les données structurées.
  • Supposer que le contenu JavaScript est lu. Certains crawlers rendent le JavaScript, beaucoup de crawlers d’IA ne le font effectivement pas. Le contenu qui n’existe qu’après un rendu côté client leur est invisible. Rendez côté serveur tout ce que vous voulez voir cité.

Scan gratuit face à l’audit complet : la frontière honnête

Le scan gratuit suffit pour répondre à « ce domaine est-il fondamentalement ouvert aux affaires avec les moteurs de recherche et d’IA ? ». Il lit une page plus les fichiers d’accès, et comme ces fichiers sont à l’échelle du site, un constat sur robots.txt ou llms.txt s’applique à tout votre domaine. Lancez-le avant et après chaque mise en production significative ; il ne coûte rien.

Il ne suffit pas pour une assurance à l’échelle du site. Il ne peut pas trouver les liens brisés de la page 40, la chaîne de redirection dans vos archives de blog, ou le modèle qui a perdu son schéma FAQ le mois dernier. C’est l’audit intégré : le crawler de site suit les liens internes à travers le site (en respectant robots.txt et noindex, avec une profondeur et un rendu JavaScript configurables), la plupart des sites de moins de mille pages terminent en quelques minutes, et chaque page est vérifiée et notée pour la citabilité par le quality gate. Les constats atterrissent dans une seule file priorisée aux côtés de vos manques de suivi des citations dans l’IA, ce qui est tout l’intérêt de l’agent AEO Goal : trouver le manque, livrer la correction concrète, revérifier qu’elle a fonctionné. Pour une checklist manuelle à traiter en attendant, la checklist de SEO technique est gratuite.

Frequently asked questions

Puis-je lancer un audit SEO technique gratuit ici ?

Oui, un vrai, limité à une page. Le scan gratuit de visibilité dans l'IA de la page d'accueil récupère en direct votre page d'accueil, robots.txt et llms.txt, vérifie l'accès des crawlers d'IA pour 16 user agents, l'indexabilité, les balises canoniques, les données structurées JSON-LD, la structure du H1 et les métadonnées, et renvoie une liste de problèmes notés sans inscription. L'exploration à l'échelle du site est l'audit intégré.

Qu'ajoute l'audit intégré complet par rapport au scan gratuit ?

La couverture à l'échelle du site et la récurrence. Le crawler de site suit les liens internes à travers votre site, et l'audit vérifie les liens internes brisés, les chaînes de redirection, les titres et métas dupliqués et manquants, les pages lentes, le JSON-LD malformé, le schéma FAQ manquant, et les pages sans structure question-réponse. Les audits peuvent tourner chaque semaine ou chaque mois et les constats peuvent être poussés vers un tableau de tickets.

Quelle est la différence entre explorabilité et indexabilité ?

L'explorabilité, c'est si un bot est autorisé à récupérer une URL, régie par robots.txt et les réponses du serveur. L'indexabilité, c'est si une page récupérée est autorisée dans l'index, régie par les directives noindex et les balises canoniques. Une page peut être explorable mais non indexable, et, chose déroutante, une page bloquée à l'exploration peut tout de même être indexée à partir des liens seuls, sans son contenu.

Pourquoi le SEO technique compte-t-il pour les réponses de l'IA ?

Un moteur de réponse ne peut pas citer une page qu'il ne peut pas récupérer ou analyser. Des crawlers d'IA bloqués, un noindex accidentel, des canoniques brisées et un contenu rendu uniquement par du JavaScript côté client retirent tous silencieusement des pages du bassin de récupération dont les réponses générées tirent, quelle que soit la qualité du contenu.

À quelle fréquence un audit technique devrait-il tourner ?

Selon un calendrier, pas une seule fois. Les déploiements, les mises à jour de plugins, les changements de règles de CDN et les migrations de CMS réintroduisent constamment des problèmes techniques. Des audits récurrents hebdomadaires ou mensuels attrapent les régressions tant qu'elles sont peu coûteuses à corriger ; un audit annuel documente les dégâts au lieu de les prévenir.

Lancez votre analyse gratuite en 60 secondes

Lancez une analyse gratuite pour voir où vous vous situez sur ChatGPT, Claude, Gemini et Perplexity : quelles réponses vous citent, lesquelles citent des concurrents à votre place, et quoi corriger en premier.

Run a free scan