seo

Página no indexada en Search Console: qué razones arreglar

¿Página no indexada en Google Search Console? Muchas razones son normales. Vea qué significa cada una, cuáles le cuestan clientes, y cómo arreglar las que importan.

Usted abrió Google Search Console, o le llegó un correo suyo, y ahí está: un número en rojo de páginas marcadas «no indexadas». Debajo hay razones que se leen como códigos de error, como «Rastreada, actualmente no indexada», «Página con redirección» y «Error de servidor (5xx)». Puede parecer que su sitio web está roto y que los clientes no pueden encontrarlo. Un reporte de página no indexada suele ser mucho menos alarmante de lo que parece, porque muchas de esas filas son URL que Google está diseñado para dejar fuera. Unas cuantas, sin embargo, pueden señalar un problema real en una página que trae llamadas y clientes potenciales. El truco está en distinguir entre las dos, y usted puede hacer la mayor parte solo, en unos minutos. Al final de este artículo sabrá qué filas dejar en paz, cuáles arreglar primero, y qué va a hacer y qué no va a hacer Google después de que las arregle.

Puntos clave

No indexada no es lo mismo que rota

La propia página de ayuda de Google dice que «no indexada no es necesariamente malo», y le dice que no espere que cada URL de su sitio esté indexada.

Deje en paz las filas esperadas

Las redirecciones, los alternos canónicos correctos, los duplicados donde Google eligió la página correcta, las páginas noindex que usted quiso así y los 404 de páginas que eliminó son normales.

Arregle las filas que afectan páginas importantes

Los errores de servidor, los errores de redirección, un noindex o bloqueo de robots.txt por accidente, un 404 suave en una página real, y un 404 donde la página debería existir valen la pena arreglar.

La validación confirma el arreglo, no el posicionamiento

Validar la corrección suele tardar hasta unas dos semanas, y ni eso ni Solicitar indexación garantizan que Google indexe la página.

¿Qué significa «página no indexada» en Google Search Console?

En Google Search Console, «página no indexada» significa que Google conoce una URL pero no la puso en su índice de búsqueda. Algunas razones son esperadas, como redirecciones, duplicados y páginas que usted le dijo a Google que omitiera. Otras, como errores de servidor o un bloqueo accidental en una página importante, necesitan arreglo. Revise la razón y las URL afectadas antes de asumir que está perdiendo tráfico.

Ayuda saber qué significa «indexada». Google encuentra una URL, la rastrea (su rastreador, Googlebot, obtiene la página), procesa lo que encuentra, y después decide si añadir la página a su índice. Una página en el índice es elegible para aparecer en los resultados de búsqueda. No tiene garantizado un lugar, y no tiene garantizado un posicionamiento. La documentación de la herramienta URL Inspection de Google dice lo mismo sobre una URL inspeccionada que está en Google: puede aparecer, no que lo hará.

El reporte mismo vive bajo Indexación, luego Páginas. La tabla «Por qué las páginas no se indexan» lista cada URL que Google conoce que no está en el índice, agrupada por razón. Esa lista incluye direcciones antiguas, orígenes de redirección, versiones duplicadas de la misma página y cualquier otra cosa con la que se haya topado Google. Así que, un número grande no significa un problema grande. La página de ayuda del reporte de indexación de páginas de Google lo dice con claridad: «No espere que cada URL de su sitio esté indexada». La meta que establece es que la versión canónica de cada página importante esté indexada, es decir, la versión principal de cada página que usted quiere que la gente encuentre.

Una laptop cerrada junto a un cuaderno en blanco y un lápiz sobre un escritorio de madera pálida en luz suave de mañana.
Un conteo en rojo en Search Console es una lista para ordenar, no un veredicto sobre su sitio web.

¿Cuáles razones de «no indexada» puede dejar en paz por lo general?

Una buena parte de las filas en un reporte típico describen URL que no deberían estar en el índice de Google en absoluto. Están ahí porque Google las encontró y le está contando lo que decidió. El significado de cada una viene de la página de ayuda del reporte de indexación de páginas de Google, con un veredicto claro de lo que significa para usted. La única pregunta que hay que hacerle a cada ejemplo de URL es sencilla: ¿es esta una página a la que quiero que lleguen los clientes desde Google?

Página con redirección

Lo que dice Google: la URL no es la versión principal de la página, y redirige a otra página, así que no está indexada. Así se ve una redirección que funciona desde el lado de Google. Si movió una página y la dirección antigua reenvía a la nueva, la dirección antigua pertenece aquí. Revise que la página a la que redirige sea la correcta y esté indexada, y luego deje la fila en paz.

Página alterna con etiqueta canónica correcta

Lo que dice Google: la página es un alterno de otra, y apunta correctamente a la versión que Google indexó. Una etiqueta canónica es una pequeña línea en el código de una página que dice «esta es la versión principal». Cuando Google la sigue, el alterno se queda fuera del índice y la página principal se queda dentro. Google describe esto como un buen resultado, y no hay nada que arreglar.

Duplicada sin canónica elegida por el usuario

Lo que dice Google: Google cree que la página es un duplicado de otra, la página no dijo cuál versión es la principal, y Google eligió una página distinta como la canónica. Esto suele ser inofensivo, por ejemplo cuando la misma página se puede llegar con y sin un código de seguimiento al final de la dirección. Use URL Inspection para ver qué página eligió Google. Si Google eligió la que usted quiere, puede dejarla. Si eligió la equivocada, eso pasa al grupo de «arreglar» de abajo. La guía de Google sobre qué es la canonicalización explica cómo elige una página entre copias casi idénticas.

URL marcada «noindex» o bloqueada por robots.txt, cuando usted lo quiso así

La etiqueta noindex (reportes más antiguos la llamaban «Excluida por etiqueta noindex») significa que Google encontró una instrucción noindex en la página y no la indexó. La etiqueta robots.txt significa que el archivo robots.txt de su sitio bloqueó a Google de rastrear la página. Si estas son páginas que usted quiso mantener fuera, como una página de agradecimiento tras un formulario, una página de inicio de sesión o una página de prueba, el reporte está mostrando que sus propias instrucciones funcionan.

No encontrada (404), para páginas que eliminó

Lo que dice Google: la URL devolvió un error 404 cuando Google la solicitó. Un 404 es la respuesta estándar de «esta página no existe». Si usted eliminó una página a propósito y no hay un reemplazo cercano, un 404 es la respuesta correcta. Una página eliminada no necesita ser forzada de vuelta al índice.

Una pequeña pila de carpetas de papel viejas atadas con cuerda, apartadas en la esquina de un estante de madera.
Las páginas retiradas, las redirecciones y los duplicados se supone que se queden fuera del índice.

¿Cuáles errores de Google Search Console pueden costarle clientes?

Las mismas etiquetas se vuelven un problema real cuando las URL de ejemplo incluyen una página a la que sus clientes necesitan llegar: su página de inicio, una página de servicio principal, un producto, una ubicación o su página de contacto. Una de estas filas no es prueba de tráfico perdido por sí sola, pero vale la pena arreglarla porque puede impedir que Google, y a veces los visitantes, lleguen a esa página. Las razones de abajo son las primeras que hay que revisar. La tabla después de ellas resume cada razón común en un solo lugar.

Error 5xx de Google Search Console: errores de servidor

Lo que dice Google: su servidor devolvió un error de nivel 500 cuando se solicitó la página. Eso significa que el sitio no respondió, ya sea por una caída del proveedor de hosting, una actualización rota, una regla de firewall o un límite de recursos. Un solo bache corto puede resolverse solo. Un patrón repetido en páginas importantes necesita arreglarse en el proveedor de hosting o en el código del sitio, porque un visitante que llegue en ese momento también puede ver un error. Si el patrón sigue regresando, puede ser más un problema de hosting web que de búsqueda.

Error de redirección de página no indexada

Lo que dice Google: Google se topó con un bucle de redirección, una cadena de redirecciones demasiado larga, una dirección final demasiado larga, o una dirección de redirección mala o vacía. En términos sencillos, el reenvío dio vueltas en círculo o nunca llegó. El arreglo es una sola redirección permanente que va directo de la dirección antigua a la página final correcta. Esto suele aparecer después de un rediseño o un cambio de plataforma, cuando las direcciones antiguas fueron reenviadas en varios saltos.

Un noindex o bloqueo de robots.txt por accidente

Las mismas etiquetas noindex y robots.txt del grupo «déjelo en paz» son un problema cuando están en una página que usted quiere encontrar. Una configuración noindex que quedó de una versión de prueba del sitio, o una casilla en un constructor de sitios que oculta páginas de los motores de búsqueda, puede mantener a toda una página de servicio fuera de Google. Elimine la instrucción, y después pruebe la página en vivo. Note una diferencia que Google señala en su guía sobre bloquear la indexación con noindex: robots.txt bloquea el rastreo, pero Google puede seguir indexando una dirección bloqueada si otras páginas la enlazan, así que noindex es la herramienta para mantener una página fuera de los resultados.

Página que no se puede indexar: 404 suave

Lo que dice Google: la página muestra un mensaje amigable de estilo «no encontrado» pero no envía una respuesta 404 real. Google está diciendo que la página se ve vacía o como un error, aunque el servidor diga que está bien. Si la página realmente ya no existe, haga que devuelva un 404 real (o 410). Si es una página real que usted quiere que se encuentre, necesita suficiente contenido real para que valga la pena indexarla, ya que una plantilla vacía o una página que solo dice «próximamente» puede caer aquí.

Error 404 de Google Search Console en una página que debería existir

Un 404 solo es un problema cuando se supone que la página debería estar ahí, o cuando una página antigua se movió y existe un reemplazo cercano. En ese caso, restaure la página o redirija la dirección antigua a su sucesora. Si cambió de plataforma, por ejemplo después de que un constructor de sitios web cerró o cambió su plan, las direcciones antiguas sin redirecciones son un lugar común donde se acumulan estos casos.

Duplicada, Google eligió una canónica distinta a la del usuario

Lo que dice Google: su página dijo cuál versión es la principal, y Google eligió una página distinta de todos modos. Cuando esto toca una página importante, revise que sus etiquetas canónicas, enlaces internos y mapa del sitio apunten todos a la misma versión. Señales mezcladas, donde una plantilla o complemento crea varias versiones de una misma página, es lo usual que hay que limpiar.

El reporte de Google también lista algunas razones de acceso: «Bloqueada por solicitud no autorizada (401)», «Bloqueada por acceso prohibido (403)» y «URL bloqueada por otro problema 4xx». Estas significan que a Googlebot se le pidió iniciar sesión, se le rechazó, o se le dio otro error del lado del cliente. Solo importan cuando afectan una página pública, con frecuencia porque una configuración de seguridad está alejando a Googlebot.

Un solo cable de red enrollado suelto junto a un pequeño router cerrado sobre un estante gris liso.
Un error de servidor repetido en una página de servicio es el tipo de fila que merece atención primero.
Razones de indexación de páginas: qué dice Google y qué hacer
Razón en el reporteQué dice Google que significaPor lo generalQué hacer
Página con redirecciónLa URL redirige a otra páginaNormalRevisar que el destino sea correcto y esté indexado
Página alterna con etiqueta canónica correctaApunta correctamente a la versión principal indexadaNormalNada
Duplicada sin canónica elegida por el usuarioUn duplicado sin versión principal declarada; Google eligió unaCon frecuencia normalConfirmar que Google eligió la página correcta
URL marcada «noindex»Google encontró una instrucción noindexNormal si fue intencionalEliminarla solo de las páginas que quiere que se encuentren
URL bloqueada por robots.txtrobots.txt bloqueó el rastreoNormal si fue intencionalDesbloquear las páginas que quiere que se encuentren
No encontrada (404)La URL devolvió un 404Normal para páginas eliminadasRestaurar o redirigir si la página debería existir
404 suaveSe ve como una página de «no encontrado» sin devolver un 404Problema en una página realAñadir contenido real o devolver un 404 verdadero
Error de servidor (5xx)El servidor devolvió un error de nivel 500Problema si se repiteArreglar en el proveedor de hosting o en el código del sitio
Error de redirecciónBucle, cadena larga, demasiado larga o vacíaProblemaUna sola redirección permanente directa
Rastreada, actualmente no indexadaRastreada pero no indexada; puede indexarse más tardeDepende de la páginaRevisar las páginas importantes; no hace falta reenviar
Descubierta, actualmente no indexadaEncontrada pero no rastreada todavíaDepende de la páginaEsperar; revisar las páginas importantes
Razón en el reportePágina con redirección
Qué dice Google que significaLa URL redirige a otra página
Por lo generalNormal
Qué hacerRevisar que el destino sea correcto y esté indexado
Razón en el reportePágina alterna con etiqueta canónica correcta
Qué dice Google que significaApunta correctamente a la versión principal indexada
Por lo generalNormal
Qué hacerNada
Razón en el reporteDuplicada sin canónica elegida por el usuario
Qué dice Google que significaUn duplicado sin versión principal declarada; Google eligió una
Por lo generalCon frecuencia normal
Qué hacerConfirmar que Google eligió la página correcta
Razón en el reporteURL marcada «noindex»
Qué dice Google que significaGoogle encontró una instrucción noindex
Por lo generalNormal si fue intencional
Qué hacerEliminarla solo de las páginas que quiere que se encuentren
Razón en el reporteURL bloqueada por robots.txt
Qué dice Google que significarobots.txt bloqueó el rastreo
Por lo generalNormal si fue intencional
Qué hacerDesbloquear las páginas que quiere que se encuentren
Razón en el reporteNo encontrada (404)
Qué dice Google que significaLa URL devolvió un 404
Por lo generalNormal para páginas eliminadas
Qué hacerRestaurar o redirigir si la página debería existir
Razón en el reporte404 suave
Qué dice Google que significaSe ve como una página de «no encontrado» sin devolver un 404
Por lo generalProblema en una página real
Qué hacerAñadir contenido real o devolver un 404 verdadero
Razón en el reporteError de servidor (5xx)
Qué dice Google que significaEl servidor devolvió un error de nivel 500
Por lo generalProblema si se repite
Qué hacerArreglar en el proveedor de hosting o en el código del sitio
Razón en el reporteError de redirección
Qué dice Google que significaBucle, cadena larga, demasiado larga o vacía
Por lo generalProblema
Qué hacerUna sola redirección permanente directa
Razón en el reporteRastreada, actualmente no indexada
Qué dice Google que significaRastreada pero no indexada; puede indexarse más tarde
Por lo generalDepende de la página
Qué hacerRevisar las páginas importantes; no hace falta reenviar
Razón en el reporteDescubierta, actualmente no indexada
Qué dice Google que significaEncontrada pero no rastreada todavía
Por lo generalDepende de la página
Qué hacerEsperar; revisar las páginas importantes

¿Es malo «Rastreada, actualmente no indexada»?

No por sí sola. Lo que dice Google sobre «Rastreada, actualmente no indexada» es que la página fue rastreada pero no indexada, y puede o no indexarse en el futuro. Google también dice que no hace falta reenviar la URL. La etiqueta no significa una penalización, y Google no publica una sola causa ni un arreglo garantizado para ella.

«Descubierta, actualmente no indexada» es un paso anterior. Google encontró la URL pero todavía no la ha rastreado. Google dice que suele posponer el rastreo porque hacerlo en ese momento podría haber sobrecargado el sitio, así que la fecha del último rastreo suele estar en blanco.

Ambas etiquetas importan solo cuando las URL de muestra incluyen páginas que usted necesita que se encuentren, y esas páginas se quedan fuera con el tiempo. Si eso pasa, vea la página con ojos de cliente. ¿Es claramente distinta de sus otras páginas, y responde algo que un visitante buscaría? Mejórela solo si de verdad merece un lugar, asegúrese de que otras páginas de su sitio la enlacen, y después déle tiempo a Google para volver.

Una cosa que puede dejar de lado en un sitio normal de pequeño negocio es el «presupuesto de rastreo». La guía de presupuesto de rastreo de Google está escrita para sitios muy grandes que cambian seguido. Para un sitio sin una gran cantidad de páginas que cambian rápido, Google dice que mantener su mapa del sitio actualizado y revisar el reporte de indexación de páginas es suficiente.

¿Cómo revisa su propio reporte en quince minutos?

No necesita despejar cada fila. Necesita averiguar si alguna página importante está atrapada en un problema real. Este pase corto, todo dentro de Search Console, responde eso.

  1. Abra Indexación, luego Páginas: Anote cada razón en la tabla «Por qué las páginas no se indexan» y su conteo.
  2. Empiece por las filas grandes o crecientes: Abra las razones con el conteo más grande o un salto repentino.
  3. Lea las URL de ejemplo: Marque cualquier página a la que quiera que lleguen los clientes, como su página de inicio, páginas de servicio, productos, ubicaciones y página de contacto.
  4. Inspeccione una página marcada: Péguela en URL Inspection y anote el estado, el último rastreo, si el rastreo y la indexación están permitidos, la canónica que usted declaró y la que Google eligió.
  5. Pruebe la página en vivo si algo cambió: Use Probar URL en vivo cuando acabe de arreglar algo o sospeche un problema de acceso, ya que el reporte puede reflejar un rastreo anterior.
  6. Clasifique cada URL marcada: Pensada para excluirse, eliminada sin reemplazo, movida a una página nueva, o una página importante que debería estar disponible. Solo el último grupo, más cualquier falla técnica repetida, va a su lista de arreglos.

Si nada en su lista de arreglos es una página que importa, terminó. El número rojo puede quedarse rojo. Si algo sí importa, ahora sabe exactamente cuál página, cuál razón y qué vio Google, lo cual hace el arreglo, o la conversación con quien construye su sitio, mucho más corta. Un arreglo puede ser pequeño, como destildar una configuración de ocultar de la búsqueda o corregir una redirección. También puede ser más grande, como una regla canónica que una plantilla repite en cientos de páginas o una serie de errores de servidor. El reporte solo no puede decirle el tamaño del trabajo; la URL inspeccionada y el patrón detrás de ella sí pueden.

Una taza de café junto a una lista corta en papel en blanco con marcas de lápiz ilegibles, sobre una mesa de cocina.
Ordene primero las URL de ejemplo. Solo las páginas importantes con un problema real van a la lista de arreglos.

¿Validar la corrección hace que Google indexe la página?

No. Validar la corrección es cómo le dice a Google que arregló un problema reportado. Después de arreglar cada instancia de una razón, abra la página de detalle de esa razón y elija Validar corrección. Google revisa algunos ejemplos de inmediato, pone en cola las revisiones del resto, se detiene si encuentra una instancia todavía rota, y le envía un correo con el resultado. Según la página de ayuda sobre detalles de validación de Google, la validación «suele tardar hasta unas dos semanas, pero en algunos casos puede tardar mucho más».

Una validación aprobada significa que Google ya no encuentra ese problema en las URL que conoce. No significa que las páginas se vayan a indexar, posicionar o traer más llamadas. Google también actualiza los conteos durante el rastreo normal, valide o no.

Solicitar indexación, en URL Inspection, es el otro botón al que la gente recurre. Es razonable para una sola página importante que acaba de publicar o arreglar. La pone en una cola, y Google dice que no garantiza que la página sea incluida. Para muchas páginas cambiadas a la vez, enviar un mapa del sitio actualizado es la mejor ruta. No hace falta presionar ninguno de los dos botones una y otra vez, y para «Rastreada, actualmente no indexada» Google dice que no hace falta reenviar en absoluto.

¿Cuándo vale la pena pagarle a alguien para arreglarlo?

Con frecuencia, no. Si sus URL de ejemplo son redirecciones, páginas noindex intencionales, alternos canónicos correctos, variantes duplicadas o páginas eliminadas que devuelven un 404 correcto, el reporte no es evidencia de que algo esté roto, y no necesita comprar un arreglo. Tenga cuidado con cualquier oferta de «indexar cada página», porque el propio Google no espera eso, y nadie puede prometer que Google indexará o posicionará una página.

La ayuda vale la pena pagarla cuando la revisión de quince minutos revela algo real en páginas que importan: errores de servidor repetidos, bucles de redirección después de un rediseño, páginas de servicio ocultas por un noindex accidental, 404 suaves en páginas reales, o Google eligiendo la versión equivocada en todo un grupo de páginas. Esos requieren diagnóstico técnico, un arreglo en la fuente, una prueba en vivo y seguimiento en Search Console. El mantenimiento de sitios web continuo también puede detectar errores de servidor y redirecciones rotas antes de que se acumulen en el reporte.

¿Puede leer su reporte de indexación de páginas?

Elija una respuesta para empezar.

1. Su reporte muestra 40 URL bajo «Página con redirección». ¿Qué debería hacer por lo general?

2. ¿Qué confirma pasar Validar corrección?

3. Su página principal de servicio aparece bajo «URL marcada 'noindex'». ¿Cuál es el siguiente paso más probable?

Preguntas frecuentes sobre página no indexada

¿Qué significa página no indexada?

Significa que Google conoce la URL pero no la ha añadido a su índice de búsqueda. Algunas razones son esperadas, como redirecciones, duplicados y páginas que usted eligió ocultar. Otras, como errores de servidor en páginas importantes, necesitan arreglo.

¿Necesito arreglar cada página no indexada por Google?

No. Google dice que no indexada no es necesariamente malo y que no debería esperar que cada URL esté indexada. Enfóquese en la versión principal de cada página importante.

¿Es malo Rastreada, actualmente no indexada?

No por sí sola. Google rastreó la página y no la indexó, y eso puede cambiar después. Google dice que no hace falta reenviarla. Vea más de cerca solo si las páginas importantes se quedan fuera.

¿Página con redirección es un error?

Por lo general no. La dirección redirige, así que no está indexada. Revise que la página a la que reenvía sea la correcta y esté indexada.

¿Cuánto tarda Validar corrección?

Google dice que la validación suele tardar hasta unas dos semanas, y a veces mucho más. Un resultado aprobado confirma que el problema desapareció, no que las páginas se vayan a indexar o posicionar.

¿Solicitar indexación garantiza que Google indexe mi página?

No. Pone la página en una cola para que Google la revise. Google decide si la página entra a su índice.

Lo que esto significa para usted

Un número rojo de «no indexada» en Search Console es una lista de URL y la razón de Google para cada una, no una calificación de su sitio web. Muchas de esas filas, como redirecciones, alternos canónicos correctos, páginas noindex intencionales y páginas eliminadas que devuelven un 404, son Google haciendo lo que debe. Las filas que valen su tiempo son las que tocan páginas a las que los clientes necesitan llegar, sobre todo errores de servidor, errores de redirección, bloqueos accidentales y 404 suaves. Arreglarlas elimina una barrera, y Google sigue decidiendo qué entra a su índice.

Una vez que sepa cuáles filas importan, el reporte deja de ser una fuente de preocupación y se convierte en una revisión mensual rápida. Usted arregla problemas reales en las páginas que traen negocio, deja el resto en paz, y deja de gastar tiempo en URL que nunca estuvieron pensadas para encontrarse.

Si su revisión revela algo que preferiría delegar, Web Leveling puede revisar su reporte con usted, confirmar cuáles filas afectan páginas importantes, y arreglar las causas que podamos verificar. Nuestro trabajo de posicionamiento en buscadores incluye este tipo de revisión de indexación, seguida de una prueba en vivo y una revisión de Search Console. Si su reporte no muestra nada que necesite pago, también se lo diremos. Trabajamos con negocios pequeños y medianos en todo el país y en el extranjero. Envíenos lo que muestra su reporte de indexación de páginas, y le ayudaremos a ordenarlo.

Términos

Palabras de indexación de Search Console en este artículo

Toque un término para ver qué significa.

Índice. El almacén de páginas de Google que son elegibles para aparecer en los resultados de búsqueda.

Rastreo. Cuando Googlebot, el rastreador de Google, obtiene una página para leerla.

Canónica. La versión principal de una página cuando varias direcciones muestran el mismo contenido o uno parecido.

Redirección. Una instrucción que envía a los visitantes y a Google de una dirección a otra.

Noindex. Una instrucción en una página que le dice a Google que no la incluya en los resultados de búsqueda.

Robots.txt. Un archivo en su sitio que le dice a los rastreadores qué direcciones no pueden rastrear.

404 suave. Una página que se ve como «no encontrado» para Google pero no envía una respuesta 404 real.