Qué es una auditoría SEO técnica
Una auditoría SEO técnica responde a una sola pregunta: ¿puede la página correcta ser descubierta, obtenida, indexada, comprendida y reutilizada, tanto por los motores de búsqueda como por los motores de respuesta con IA? Todo lo demás en un programa de SEO o de Answer Engine Optimization se apoya sobre ese sí. La calidad del contenido, los backlinks y un posicionamiento brillante no valen nada para una página que los rastreadores nunca llegaron a leer con éxito.
Esto es lo que puedes hacer realmente desde esta página, dicho sin rodeos. El escaneo gratuito de visibilidad en IA es una auditoría técnica real y en vivo, acotada a una página: introduce un dominio sin registrarte y obtiene tu página de inicio, robots.txt y llms.txt, descubre tu sitemap, comprueba el acceso a robots.txt de 16 agentes de usuario de rastreadores de IA, y verifica la indexabilidad, las etiquetas canónicas, los datos estructurados JSON-LD, la estructura de H1, la salud del título y la meta descripción, y las etiquetas Open Graph. Devuelve una puntuación de 0 a 100 y una lista de incidencias ordenada. La versión de todo el sitio, que rastrea cada página interna y se vuelve a ejecutar según una programación, es la función de auditoría dentro de la aplicación.
Las cuatro puertas que una página debe superar
El SEO técnico deja de ser una lista de comprobación de 200 puntos en cuanto lo ves como cuatro puertas secuenciales. Una página que falla en la puerta uno nunca llega a ser juzgada en la puerta cuatro.
Puerta 1: Obtención. El servidor debe devolver la página. Los tiempos de espera agotados, los errores 5xx, las reglas de WAF y CDN que desafían a los bots, y las cadenas de redirección que nunca se resuelven fallan todas en esta puerta. Los rastreadores de IA fallan aquí de forma desproporcionadamente frecuente, porque los ajustes preestablecidos de protección contra bots suelen bloquear sus agentes de usuario por defecto mientras dejan pasar a Googlebot.
Puerta 2: Permiso de rastreo. robots.txt decide quién puede obtener qué. Un descuidado Disallow: / en una plantilla, o una regla general copiada del entorno de pruebas, elimina secciones enteras del alcance de todos los rastreadores. La guía de robots.txt cubre en detalle las reglas y los agentes de usuario de los rastreadores de IA.
Puerta 3: Elegibilidad para indexación. Una página ya obtenida aún necesita permiso para ser almacenada y servida: sin directivas noindex perdidas, con una etiqueta canónica que apunte a donde pretendes, y sin un clúster de duplicados que confunda cuál es la URL real. La clásica herida autoinfligida vive aquí: una metaetiqueta noindex enviada desde el entorno de pruebas a producción.
Puerta 4: Extracción. La página debe ser comprensible. JSON-LD válido que coincida con el contenido visible, un H1 claro, encabezados que delimiten las secciones, y respuestas expresadas en prosa extraíble en lugar de enterradas en widgets renderizados en el cliente. Esta puerta apenas importaba hace una década; para los motores de respuesta es decisiva, porque citan pasajes, no páginas.
Cómo leer los hallazgos de la auditoría
| Hallazgo | Puerta | Urgencia |
|---|---|---|
| Errores de servidor, redirecciones irresolubles | Obtención | Inmediata: la página no existe para los rastreadores |
| Rastreadores de IA bloqueados en robots.txt | Rastreo | Inmediata si quieres visibilidad en respuestas de IA; política deliberada si no |
| noindex accidental, canónicas en conflicto | Indexación | Inmediata: se está descartando contenido elegible |
| Cadenas de redirección | Obtención e indexación | Alta: cada salto desperdicia presupuesto de rastreo y diluye señales |
| Enlaces internos rotos | Rastreo | Alta: fugan rutas de descubrimiento y confianza del usuario |
| Títulos y metadatos duplicados o ausentes | Extracción | Media: corregir por lotes según la plantilla |
| JSON-LD mal formado o ausente | Extracción | Media-alta para AEO: el esquema es cómo los motores resuelven entidades |
| Páginas lentas (LCP) | Obtención y experiencia de usuario | Media: corrige primero los peores casos |
| Sin estructura de pregunta y respuesta | Extracción | El hallazgo específico de AEO: la página se puede leer pero no citar |
Dos reglas de interpretación. Primera, la gravedad es posicional: una incidencia media en tu plantilla de mayor conversión pesa más que una incidencia crítica en una página de etiquetas olvidada. Pondera los hallazgos según el tráfico y los ingresos de las páginas afectadas. Segunda, cuenta las incidencias por causa raíz, no por instancia: cinco mil avisos de título duplicado suelen ser un único error de plantilla, lo que significa un ticket, no cinco mil.
Reglas de decisión para trabajar el backlog
- Nunca audites sin corregir. Una auditoría que termina en un PDF es una táctica dilatoria. Cada hallazgo debería convertirse en un ticket con responsable; la auditoría dentro de la aplicación envía los hallazgos directamente a un tablero de tickets precisamente por esta razón.
- Trabaja las puertas en orden. Primero las correcciones de obtención y rastreo, segundo las de indexación, tercero las de extracción. Optimizar el esquema en una página que los rastreadores de IA no pueden obtener es como pulir los muebles de una casa cerrada con llave.
- Corrige plantillas, no páginas. La mayor parte de la deuda técnica la generan las plantillas. Una corrección de plantilla repara miles de URL de una sola vez.
- Vuelve a ejecutar tras cada lote de correcciones. El escaneo gratuito es repetible bajo demanda, y la auditoría dentro de la aplicación se ejecuta semanal o mensualmente. Un hallazgo no está corregido hasta que una nueva ejecución deja de reportarlo.
- Vigila las regresiones, no solo las correcciones. La captura más valiosa de la auditoría es la nueva incidencia que apareció tras el despliegue del martes, mientras afecta a días de tráfico en lugar de meses.
Errores frecuentes
- Auditar una vez al año. La salud técnica se degrada con cada versión. Las auditorías anuales documentan el daño; las auditorías programadas lo previenen.
- Confiar en las comprobaciones de SEO ignorando el acceso de la IA. Un sitio puede ser impecable para Googlebot e invisible para GPTBot, PerplexityBot y ClaudeBot porque un ajuste preestablecido del firewall los bloqueó. Las herramientas de auditoría clásicas rara vez comprueban esto; el escaneo gratuito lo comprueba primero.
- Bloquear una página que quieres desindexar. Para retirar una página indexada, los rastreadores deben poder obtener la directiva noindex. Bloquear la URL en robots.txt conserva el listado obsoleto en lugar de retirarlo.
- Esquema que contradice la página. Los datos estructurados que describen contenido que no está visiblemente presente son un lastre para la credibilidad. Valida frente a lo que ven los usuarios; consulta la entrada del glosario sobre datos estructurados.
- Dar por hecho que el contenido en JavaScript se lee. Algunos rastreadores renderizan JavaScript, muchos rastreadores de IA en la práctica no. El contenido que solo existe tras el renderizado del lado del cliente es invisible para ellos. Renderiza en el servidor todo lo que quieras que se cite.
Escaneo gratuito frente a auditoría completa: el límite honesto
El escaneo gratuito basta para responder a “¿está este dominio fundamentalmente abierto al negocio con los motores de búsqueda y de IA?”. Lee una página más los archivos de acceso, y como esos archivos son de todo el sitio, un hallazgo de robots.txt o llms.txt se aplica a todo tu dominio. Ejecútalo antes y después de cada versión importante; no cuesta nada.
No basta para dar garantías de todo el sitio. No puede encontrar los enlaces rotos de la página 40, la cadena de redirección del archivo de tu blog, ni la plantilla que perdió su esquema FAQ el mes pasado. Para eso está la auditoría dentro de la aplicación: el rastreador del sitio sigue los enlaces internos por todo el sitio (respetando robots.txt y noindex, con profundidad y renderizado de JavaScript configurables), la mayoría de los sitios con menos de mil páginas terminan en minutos, y cada página se comprueba y puntúa según su citabilidad mediante la quality gate. Los hallazgos aterrizan en una única cola priorizada, junto a las brechas de tu seguimiento de citaciones en IA, que es el objetivo del agente de AEO Goal: encuentra la brecha, envía la corrección concreta, vuelve a comprobar que funcionó. Para una lista de comprobación manual con la que avanzar mientras tanto, la lista de comprobación de SEO técnico es gratuita.