Analítica

Indexación de páginas, el informe que delata tu blog jurídico

El informe de indexación de páginas de Search Console revela qué artículos de tu blog rastrea Google y cuáles no llega a mostrar nunca.

El informe de indexación de páginas de Search Console separa lo que Google ve de lo que de verdad saca a búsqueda: cuántas URL de tu blog están indexadas y cuántas se han quedado a medias, descubiertas o rastreadas pero nunca incorporadas. Para un despacho que paga por contenido cada semana, entender esa diferencia es la única forma de saber si el trabajo de meses está compitiendo por clientes o durmiendo sin que nadie lo vea.

El informe de indexación de páginas de Search Console clasifica cada URL de tu web en un estado; solo «Indexada» significa que puede salir en resultados. Si predominan «Descubierta: actualmente sin indexar» o «Rastreada: actualmente sin indexar», Google conoce tus artículos pero no los saca a búsqueda, normalmente por enlaces internos débiles o contenido que no aporta nada distinto al resto del sector.

Qué mide el informe de indexación de páginas

El informe vive en Search Console, dentro del menú «Indexación», y reemplazó al antiguo informe de cobertura. Su primer gráfico separa las URL en dos bloques: las indexadas, que pueden aparecer en resultados, y las que no, agrupadas por el motivo exacto que Google asigna a cada una. Esa segunda lista es la que casi nadie revisa, y es la que explica por qué un artículo con buena palabra clave no trae ni una visita.

Cada motivo tiene su propia página con ejemplos de URL afectadas, así que no hace falta adivinar cuál de tus artículos tiene el problema. Según la propia ayuda de Search Console, algunos estados —bloqueada por robots.txt, marcada con «noindex»— son intencionados; otros, como los dos siguientes, señalan que Google todavía no ha decidido si tu contenido merece un hueco en el índice.

Los estados que impiden indexar tus artículos

Dos estados concentran la mayoría de los artículos de blog que nunca llegan a indexarse, y se confunden con facilidad porque suenan parecido. La diferencia está en si Google ya visitó la página o no, y eso cambia por completo qué hay que corregir en cada caso.

Descubierta: actualmente sin indexar, la cola de rastreo

Este estado significa que Google sabe que la URL existe —normalmente porque apareció en el sitemap o en un enlace interno— pero todavía no ha enviado a Googlebot a visitarla. No es un error técnico: es una URL en cola, y la cola tiene prioridades. Un artículo enterrado a cuatro o cinco clics de la portada, sin que ninguna otra página del blog lo enlace, manda la señal de que no es importante y Google lo deja esperando semanas. Muchas veces la causa ni siquiera está en el artículo: es la arquitectura web la que esconde páginas enteras detrás de un menú mal planteado.

Cuando el rastreo no basta para indexar

El segundo estado es distinto porque Google ya hizo su parte: visitó la página y aun así decidió no sumarla al índice. Es el que más debería preocupar a un despacho.

Rastreada: actualmente sin indexar, contenido que no convence

Aquí el rastreo sí ocurrió: Googlebot leyó la página y decidió no incorporarla. No es un problema de acceso, sino de valoración: Google comparó ese artículo con lo que ya tiene indexado sobre el mismo tema y no encontró motivo para sumar uno más. Suele pasar con piezas que repiten un ángulo ya cubierto en el propio blog, con páginas de área de práctica casi idénticas cambiando solo el nombre del servicio, o con textos demasiado cortos para la promesa del título. La solución no es reescribir con sinónimos: es añadir un dato, un caso o una cifra propia que la versión anterior no tenía.

Por qué Google frena el rastreo en despachos pequeños

Aquí conviene desmontar un miedo habitual. La documentación de Google sobre gestión del presupuesto de rastreo es explícita: esta optimización está pensada para sitios de más de un millón de páginas, o de más de diez mil con cambios diarios. El blog de un despacho, con unas pocas decenas o cientos de artículos, no compite por presupuesto de rastreo en ese sentido: Google tiene capacidad de sobra para visitarlo entero cada semana, siempre que la velocidad de carga del servidor no le ponga trabas.

Google define el presupuesto de rastreo como el conjunto de URL que puede y quiere rastrear en un sitio, según la capacidad de su servidor y la demanda real de esas páginas.

Lo que sí afecta a un sitio pequeño es la demanda de rastreo por página: la propia guía señala que una URL sin enlaces internos que apunten a ella se trata como de baja prioridad aunque el sitio entero sea diminuto. La causa técnica del despacho grande y la del pequeño son distintas, pero el síntoma en el informe es idéntico.

El contenido casi duplicado frena la indexación

El otro factor que Google menciona como consumidor de rastreo, pensado para catálogos enormes, se reproduce a escala pequeña en cualquier despacho con varias páginas de área de práctica: «Derecho laboral en Madrid», «Derecho laboral en Barcelona» y «Derecho laboral en Valencia» con el mismo texto y solo la ciudad cambiada son, para Google, prácticamente la misma URL repetida tres veces. El buscador elige una como versión canónica y descarta el resto, que aparecen como página alternativa en el informe, no como error.

Evitarlo exige que cada página aporte algo que las demás no tienen: normativa autonómica concreta, un caso resuelto en esa provincia, cifras locales de mercado. Sin esa diferencia real, tener diez variantes de la misma página no multiplica las posibilidades de aparecer: las reparte entre sí y ninguna gana fuerza suficiente para posicionar.

Cómo lograr que Google indexe tus artículos nuevos

Antes de tocar nada conviene aclarar un malentendido frecuente: la Indexing API de Google, la que permite avisar de una URL nueva por vía automática, solo está autorizada para páginas de ofertas de empleo y eventos en directo. Un despacho de abogados no puede usarla para sus artículos, por mucho que algún plugin la anuncie como solución universal. Para contenido de blog, el único canal oficial sigue siendo la herramienta de inspección de URL dentro de Search Console, y es manual.

  • Enlaza cada artículo nuevo desde al menos dos páginas ya indexadas del blog, con texto de anclaje que describa el tema, no un genérico «leer más».
  • Mantén el sitemap XML actualizado y con la fecha real de publicación en «lastmod», para que Google sepa qué es nuevo sin rastrear todo el sitio para descubrirlo.
  • Revisa que ninguna plantilla del tema marque por error la página como «noindex» o apunte su etiqueta canónica a otra URL.
  • Publica con regularidad en vez de en ráfagas: un blog que añade contenido de forma constante entrena a Google para volver a rastrearlo con más frecuencia.

Solicitar indexación manual, cuándo compensa de verdad

El botón «Solicitar indexación» de la herramienta de inspección de URL sirve para avisar de un artículo puntual, no para arreglar un problema estructural. Tiene un límite diario no publicado por Google y, si se usa para forzar decenas de páginas con el mismo defecto, se agota sin resolver nada: el motivo por el que Google las descartó sigue ahí la próxima vez que las visite.

Tiene sentido pedirlo cuando acabas de corregir el fallo real —añadiste enlaces internos, reescribiste un párrafo duplicado, quitaste un «noindex» heredado de la plantilla— y quieres que Google lo compruebe antes del siguiente rastreo natural. Usado así, ahorra días. Conviene revisarlo junto con las consultas de Search Console que traen leads a tu despacho, porque una URL bien indexada pero sin consultas asociadas señala otro problema: el de la relevancia, no el del acceso.

Preguntas frecuentes sobre la indexación de páginas

¿Cuánto tarda Google en indexar un artículo nuevo?

En un blog con historial y buena estructura de enlaces internos, entre unos días y dos semanas. Un despacho nuevo o con pocas páginas indexadas puede esperar más, porque Google todavía no ha aprendido con qué frecuencia conviene visitarlo.

¿Sirve de algo pedir la indexación manualmente si no corrijo nada?

No. Google vuelve a evaluar la URL con el mismo criterio que la descartó la primera vez. Si el motivo era contenido casi duplicado o falta de enlaces internos, el resultado se repite y solo se gasta la cuota diaria de solicitudes sin necesidad.

¿La velocidad del servidor afecta a que Google indexe mis artículos?

Sí, indirectamente: si el servidor responde lento o con errores, Google reduce la frecuencia de rastreo del sitio entero, no solo de esa página. Un despacho con caídas frecuentes ve crecer el número de URL en «Descubierta: actualmente sin indexar» aunque el contenido esté bien escrito.

Fuente: Centro de ayuda de Search Console – Google

De la idea a la acción

¿Tu despacho necesita decisiones más claras?

Cuéntanos dónde quieres llegar. Pondremos estrategia, tecnología y medición al servicio de ese objetivo.

Hablemos