Academia › Publicar › Que te encuentren en Google
La etiqueta que le dice a Google que no entre
Encuentras y quitas el bloqueo exacto que le impide a Google indexar tu página: la etiqueta noindex, la línea de robots.txt o la redirección que corta el paso, y le pides a Google que vuelva a mirarla.
La Search Console ya te ha dado un motivo, de la lección anterior: excluida por etiqueta noindex, bloqueada por robots.txt o página con redireccionamiento. Lees la frase y te quedas igual: no sabes qué es, ni dónde se esconde, ni si lo puedes tocar tú o hace falta llamar a alguien.
El motivo tiene nombre técnico, pero el bloqueo es una línea de texto concreta, escrita en algún sitio de tu propia web. Hoy la vas a encontrar y la vas a quitar.
Tres sitios donde vive el bloqueo
Solo hay tres lugares donde Google puede toparse con un cartel de no entrar. Uno está dentro del código de la propia página, otro en un archivo aparte que vive en la raíz de tu dominio, y el tercero es una redirección que corta el camino antes de que Google llegue a ver nada.
Cada uno se localiza y se corrige de una forma distinta. Confundirlos hace perder días.
La etiqueta que casi siempre deja puesta el constructor
La etiqueta noindex es la marca que usan los constructores web para que una página en obras no aparezca en buscadores mientras la estás montando. Mientras trabajas, es útil. El problema llega cuando publicas la web y esa marca se queda puesta, porque publicar cambia el aspecto de la página pero no siempre borra ese ajuste.
Se ve en el código fuente, no en lo que muestra el navegador. Con el botón derecho, opción ver código fuente de la página, buscas la palabra robots. Si aparece junto a noindex, ahí está tu bloqueo.
Publicar cambia lo que ve el visitante, pero el ajuste de visibilidad para buscadores es un interruptor aparte que nadie tocó
Robots.txt y la redirección, la revisión rápida
Para el archivo robots.txt no hace falta buscar nada escondido: escribes tudominio.com/robots.txt en la barra del navegador y lo lees entero, porque suele tener cuatro o cinco líneas. Si ves Disallow: / a secas, ese archivo cierra el paso a toda la web, no solo a una página. Si ves Disallow: /servicios/, el cierre es solo para esa carpeta.
La redirección se prueba abriendo la URL exacta que te marca la Search Console. Si al pegarla acabas en la home o en otra página distinta, ahí tienes el corte: alguien configuró que todo lo antiguo vaya a parar al mismo sitio, y de paso se llevó por delante una página que sí querías conservar.
Pedir a Google que vuelva a mirar
Quitar el bloqueo no mete la página en el buscador ese mismo día. Google tiene que volver a pasar por ahí, y eso puede tardar semanas si esperas a que le toque el turno. En la Search Console, en Inspección de URL, pegas la dirección exacta de la página corregida y pulsas solicitar indexación.
Con eso adelantas el rastreo en vez de esperarlo sentado. No sustituye la revisión anterior: primero se quita el bloqueo, después se pide que Google vuelva a mirar.
- Sabes localizar la etiqueta noindex en el código fuente de una página
- Sabes leer un robots.txt y distinguir un bloqueo total de uno parcial
- Sabes reconocer una redirección que corta el paso a una página concreta
- Has pedido a Google, desde Inspección de URL, que vuelva a mirar la página ya corregida
Ponte a prueba
Responde antes de abrir cada una. Si alguna se te resiste, vuelve al apartado que la explica.
1. La Search Console marca 'bloqueada por robots.txt' solo en la página de un servicio, mientras que tu home aparece bien indexada al buscar site:tudominio.com.
Abres tudominio.com/robots.txt y buscas una línea Disallow que apunte a esa carpeta en concreto. Borras solo esa línea, no tocas el resto del archivo, porque el bloqueo no es del dominio entero.
2. Quitaste el noindex de una página hace diez días y sigue sin aparecer al buscar site:tudominio.com.
Entras en Inspección de URL dentro de la Search Console, pegas esa dirección y pides indexación. Quitar el bloqueo no adelanta el rastreo por sí solo; hay que pedirlo aparte.
3. Un cliente reformó su web hace un mes y desde entonces las páginas de sus servicios antiguos, que tenían enlaces desde otras webs, ya no aparecen: al abrirlas todas acaban en la portada.
Hay una redirección general que manda todo lo antiguo a la home. Se corrige apuntando cada URL antigua a su página nueva equivalente, no a la portada, porque si no se pierde el enlace y la posición que tenía esa página concreta.
Con la etiqueta, el robots.txt y la redirección ya corregidos, Google puede entrar. Pero que pueda entrar no significa que sepa qué hay: eso se lo dices tú con el sitemap, y el tuyo probablemente todavía miente sobre lo que existe.