Una página puede cargar perfectamente en el navegador y aun así no formar parte del índice de Google. Rastreo, indexación, canonicalización y posicionamiento son etapas distintas. Para trabajar SEO y GEO debemos entender qué sucede con cada URL, antes de atribuir su ausencia en una respuesta de IA a problemas de contenido.
Google explica que las funciones de IA de Search utilizan los fundamentos SEO conocidos y no requieren optimizaciones especiales. Por eso revisamos accesibilidad, contenido indexable, enlaces internos y consistencia de URLs antes de intentar medir si una página aparece como fuente. Guía de Google sobre funciones de IA.
Rastreo, indexación, canonical y visibilidad: la diferencia básica
| Concepto | Pregunta que responde | Dónde comprobarlo |
|---|---|---|
| Acceso HTTP | ¿La URL entrega contenido al robot? | Respuesta HTTP y registros del servidor |
| Rastreo | ¿Un agente visitó el documento? | Logs y herramientas de inspección |
| Indexación | ¿Google incorporó el contenido a su índice? | Inspección de URL de Search Console |
| Canonicalización | ¿Qué URL prefiere Google cuando hay duplicados? | Canónica declarada y seleccionada |
| Posicionamiento | ¿Para qué consultas aparece una página? | Informes de rendimiento y SERP |
| Citación IA | ¿Un sistema mostró la URL como fuente? | Observaciones explícitas de respuestas |
Una URL indexada no tiene derecho automático a recibir impresiones. Una URL con impresiones tampoco necesariamente será citada por AI Mode o ChatGPT. La visibilidad generativa requiere una medición separada, que explicamos en menciones frente a citaciones.
Qué hace exactamente una etiqueta canonical
La anotación rel="canonical" expresa una preferencia sobre cuál versión debe tratarse como principal cuando hay duplicados o páginas muy parecidas. Google la considera una señal fuerte, pero conserva la capacidad de elegir otra si encuentra información contradictoria.
Una declaración simple es:
<link rel="canonical" href="https://example.com/guia-principal/" />
Este ejemplo no ordena retirar todo el resto de las URLs del índice; tampoco equivale a una redirección de navegador. Google explica que las redirecciones, las etiquetas canonical y los sitemaps contribuyen a definir preferencias, con distinta fuerza. Documentación oficial de canonicalización.
Pensemos en dos variantes ficticias de la misma guía: https://example.com/guia/?utm_source=correo y https://example.com/guia/. El primer enlace puede incluir parámetros de seguimiento; normalmente buscaríamos consolidar la identidad del contenido bajo una URL limpia y coherente. No debemos asumir, sin inspección, que cualquier parámetro produce contenido duplicado.
Cuándo utilizar canonical, redirección o noindex
Canonical: variantes que necesitan coexistir
Si un sitio muestra contenido muy similar en varias direcciones pero existen razones técnicas para mantener las variantes, puede ser apropiado declarar una canónica. Debemos revisar que el destino sea accesible, pertinente y consistente con el sitemap y los enlaces internos.
Redirección: una URL que deja de ser el destino
Cuando una ruta antigua es reemplazada definitivamente y no es necesario mantenerla disponible, una redirección permanente suele tener sentido. No redireccionamos una página válida a otra de intención distinta solo porque el slug nuevo contiene GEO. Si la URL antigua mantiene una búsqueda SEO legítima, tenemos que preservar esa intención.
Noindex: contenido que no queremos mostrar en Google
noindex puede indicar que una URL no debe indexarse en Google, pero el robot necesita acceder a la página para ver esa directiva. Bloquearla simultáneamente en robots.txt puede impedir que Google detecte el noindex. Es una diferencia documentada en cómo bloquear la indexación.
Ninguno de estos mecanismos debe confundirse con un sistema para proteger información privada. Si una página no debe ser pública, necesitamos permisos y autenticación, no solo indicaciones a buscadores.
Cómo detectamos conflictos de canonical
Una auditoría comienza comparando tres lugares: el contenido que realmente entrega la URL, el canonical declarado en HTML y la preferencia que Google muestra en su herramienta de inspección, cuando está disponible. Si difieren, investigamos por qué.
Ejemplo ilustrativo: una guía en /seo/guia/ declara como canonical una landing comercial /servicios/. Aunque ambas hablen de posicionamiento, su intención puede ser diferente. Esa anotación requiere revisión; no la consideramos correcta solo porque ambas pertenecen al mismo tema.
También observamos enlaces internos que siguen llevando a variantes con parámetros, URLs HTTP cuando la referencia pública ya utiliza HTTPS y páginas incluidas en sitemap cuyo destino canonical apunta a otro sitio. La contradicción entre señales puede dificultar la consolidación.
No utilizamos canonical como remedio genérico para contenidos pobres o parecidos. Si dos artículos tienen objetivos casi idénticos, primero decidimos si deben consolidarse editorialmente, diferenciarse o mantenerse según su utilidad. La arquitectura precede a la etiqueta.
Procedimiento de diagnóstico en Search Console
- Elegimos una URL real que debería recibir tráfico orgánico.
- Comprobamos que responde con el contenido esperado, sin bloqueos de seguridad ni desafíos inesperados.
- Revisamos meta robots y encabezados HTTP, incluido
X-Robots-Tagcuando sea pertinente. - Leemos el canonical declarado y verificamos que el enlace apunte al contenido correcto.
- Utilizamos Inspección de URL para revisar información de rastreo, indexación y canonical elegido por Google.
- Comprobamos si la URL aparece en el sitemap correcto y si recibe enlaces internos rastreables.
- Analizamos el contenido: ¿responde a una necesidad real o replica otra página?
- Tras resolver el problema, seguimos el estado a lo largo del tiempo. No presentamos la solicitud de indexación como garantía.
Google aclara que pedir rastreo o enviar sitemap no garantiza indexación. Puede tardar y los sistemas de búsqueda deciden qué URLs incorporan. Documentación oficial para solicitar rastreo.
Casos prácticos que muestran problemas diferentes
Caso A: URL pública pero no indexada. Una guía carga con HTTP 200, tiene contenido y no presenta un bloqueo evidente. El siguiente paso es revisar la inspección de URL, los enlaces internos y la calidad de la página. No concluimos que haya sido penalizada por una IA.
Caso B: canonical a una página distinta. Un post con información propia declara como canonical una página general de servicios. Verificamos la intención de ambos documentos y revisamos si el plugin SEO o el tema estableció esa dirección accidentalmente.
Caso C: WordPress genera archivos sin utilidad editorial. Algunas taxonomías o búsquedas internas pueden generar archivos que el administrador no necesita posicionar. Los evaluamos de acuerdo con navegación, indexación y riesgo de duplicidad; no los borramos masivamente sin un inventario.
Caso D: una migración crea rutas nuevas. Es necesario mapear intención, tráfico y equivalencia antes de establecer redirecciones. Un cambio de nomenclatura SEO a GEO no demuestra que debamos cambiar el slug de todas las páginas.
Estos casos son situaciones didácticas y no describen proyectos privados.
¿Puede una IA citar páginas que Google no indexa?
No podemos establecer una norma universal para todos los motores generativos. Algunas plataformas tienen sistemas de búsqueda y recuperación propios, mientras otras experiencias utilizan índices diferentes. Por eso separamos indexación en Google, acceso de un agente específico y observación de una fuente citada.
Para la búsqueda de Google, las condiciones de rastreo y elegibilidad importan. Para ChatGPT y otros asistentes conviene además comprender los rastreadores de IA y robots.txt. No extrapolamos reglas de un proveedor a todos.
Cómo conecta con nuestros factores GEO
Dentro de los 117 factores de HatumGEO revisamos acceso HTTP, indexabilidad, robots, canonical declarado y coherencia con la versión principal. También inspeccionamos organización de enlaces, ya que una URL huérfana puede resultar difícil de encontrar para los usuarios.
Esas comprobaciones son una base técnica, no una puntuación de probabilidad de cita. Después de corregir la arquitectura, la medición de visibilidad IA requiere preguntas concretas, respuestas registradas y fuentes verificables.
Preguntas frecuentes
¿Poner canonical a una URL hace que Google la indexe?
No. Declara una preferencia sobre duplicados; no garantiza inclusión ni posicionamiento.
¿Bloquear una URL en robots.txt equivale a noindex?
No. Robots controla acceso de rastreo para agentes que respeten sus reglas; noindex debe ser visto por el crawler compatible.
¿El sitemap es suficiente para indexar?
No. Ayuda al descubrimiento, pero no impone indexación.
Fuentes
- Google: canonicalización.
- Google: noindex y acceso.
- Google: solicitar nuevo rastreo.
- Google: SEO para funciones de IA.
Conclusión: trabajamos canonical e indexación para asegurar que cada URL tenga una identidad y un propósito claros. Eso es SEO técnico verificable; convertir esa base en citas de IA exige mediciones adicionales.


