Funcionamiento del análisis de la etiqueta canónica
El Comprobador de etiqueta canónica es una herramienta diseñada para inspeccionar el código de cualquier página web pública, seguir sus redirecciones y verificar la presencia y configuración de la etiqueta rel="canonical". Al introducir una dirección web, el sistema realiza una petición HTTP, procesa el documento y extrae los datos clave del encabezado HTML.
El análisis determina si la etiqueta existe, qué dirección exacta especifica y si dicha dirección coincide con la URL que se ha introducido inicialmente o con la URL final de destino tras completarse las redirecciones. Si el usuario realiza una nueva consulta mientras hay otra en curso, la petición anterior se detiene inmediatamente para procesar la solicitud más reciente.
Parámetros de entrada y validación de direcciones
La herramienta requiere un único dato de entrada:
- URL de la página: Debe ser una dirección pública que utilice el protocolo HTTP o HTTPS.
El campo de entrada cuenta con reglas de validación estrictas que se aplican antes de enviar la consulta:
- La longitud de la dirección debe ser inferior a
{max}caracteres. Si se supera este límite, se muestra el mensaje: "La URL debe tener menos de{max}caracteres.". - No se permite la comprobación de direcciones privadas o locales (por ejemplo, entornos de desarrollo como
http://127.0.0.1/admino redes internas). En estos casos, la petición se bloquea antes de enviarse y se muestra el error: "No se pueden comprobar direcciones privadas o locales.". - Si el usuario intenta realizar la comprobación con el campo vacío, el sistema muestra el aviso: "Introduce primero la URL de una página.".
- Si la dirección no cumple con el formato de un protocolo público válido, se devuelve el error: "Introduce una URL HTTP o HTTPS pública y válida.". En caso de introducir una URL sin protocolo, esta se procesa según las reglas de validación locales.
Resultados y datos devueltos por el análisis
Una vez procesada la página, la herramienta ofrece un desglose detallado con los siguientes campos de información:
- Resultado de la etiqueta canónica: Un resumen del estado de la etiqueta (por ejemplo, "Etiqueta canónica encontrada: apunta a la propia página y coincide con la URL introducida.").
- URL canónica resuelta: La dirección web exacta que se ha extraído del atributo
hrefde la etiqueta. - Comprobaciones de la etiqueta canónica:
- Existe una etiqueta canónica: Indica "Sí" o "No".
- Autorreferente: Confirma si la etiqueta apunta a la propia página analizada.
- Coincide con la URL introducida: Verifica si el valor coincide exactamente con la dirección escrita por el usuario.
- URL introducida: La dirección web original que se ha solicitado comprobar.
- URL final tras redirecciones: La dirección de la página de destino después de haber seguido todas las redirecciones HTTP.
- href de la canonical: El valor de texto bruto que contiene el atributo
hrefen el código HTML. - Estado HTTP: El código de estado numérico devuelto por el servidor web.
- Etiquetas canónicas encontradas: El número total de etiquetas canónicas detectadas en el documento.
Gestión de errores y situaciones excepcionales
Durante el proceso de consulta y lectura del HTML pueden surgir diferentes escenarios técnicos que impiden un análisis normal. La herramienta identifica y notifica estas situaciones mediante los siguientes mensajes específicos:
- Problemas de conexión: Si el servidor de destino no responde o no es accesible, se muestra "No se pudo abrir la página. Revisa la URL o inténtalo de nuevo.". Si el tiempo de espera expira, se devuelve "La página tardó demasiado en responder. Inténtalo más tarde.".
- Redirecciones infinitas: Si la URL entra en un bucle o supera el límite de saltos, se muestra "La página redirigió demasiadas veces y no se pudo completar la comprobación.".
- Códigos de estado HTTP de error: Si el servidor responde con un código de error (como un error 404 o 500), se detiene el análisis y se muestra "La página devolvió HTTP
{status}; no se pudo comprobar su etiqueta canónica.". - Formato de archivo no válido: Si la dirección apunta a un recurso que no es una página web, se muestra "Esa URL no devolvió una página HTML.". Si el documento está vacío o corrupto, se devuelve "La página no devolvió HTML legible.".
- Tamaño excesivo: Si la sección
<head>del documento HTML supera los límites de seguridad para su procesamiento, se muestra "El head de la página es demasiado grande para comprobarlo con seguridad.". - Etiquetas múltiples: El estándar de los motores de búsqueda exige que exista una única etiqueta canónica por página. Si se detectan varias, la herramienta analiza únicamente la primera y muestra el aviso: "Se encontraron
{count}etiquetas canónicas. Se muestra la primera; deja solo una.". - Atributo no válido: Si la etiqueta existe pero su enlace no es correcto, se muestra "Hay una etiqueta canónica, pero su href no es una URL HTTP o HTTPS válida.".
- Error de portapapeles: Si el usuario intenta copiar el resultado de forma automática y el navegador lo impide, se muestra "No se pudo copiar la URL canónica. Selecciónala y cópiala manualmente.".
El papel de las etiquetas canónicas en la indexación
La etiqueta rel="canonical" es un elemento de metadatos que se inserta en la sección <head> de un documento HTML. Su función principal es indicar a los motores de búsqueda cuál es la versión preferida o "principal" de una página web cuando existen múltiples URL que muestran un contenido idéntico o muy similar.
El uso correcto de esta etiqueta evita problemas de contenido duplicado, un factor que puede dividir la autoridad de enlace entre varias páginas y dificultar el posicionamiento orgánico. Al consolidar las diferentes versiones en una sola URL canónica, los rastreadores de los buscadores concentran sus esfuerzos de indexación y valoración en la dirección correcta.
Impacto de las redirecciones y el renderizado por JavaScript
Cuando se analiza una URL, es frecuente que esta redirija a otra dirección (por ejemplo, de HTTP a HTTPS, o de una versión con "www" a otra sin ellas). El Comprobador de etiqueta canónica sigue estas redirecciones para evaluar el comportamiento real que experimentan los motores de búsqueda. Si la etiqueta canónica de la página de destino apunta a esa misma página final, se considera una configuración correcta, aunque difiera de la URL que el usuario escribió inicialmente.
Por otro lado, existe una limitación importante respecto a las etiquetas generadas mediante scripts. Esta herramienta analiza directamente el código HTML que devuelve el servidor web. Si una etiqueta canónica se inserta dinámicamente mediante JavaScript en el navegador del usuario, es muy probable que los rastreadores de los buscadores no la procesen de manera consistente o que esta herramienta no la detecte. Por ello, se recomienda que las etiquetas canónicas críticas se encuentren siempre escritas directamente en el código fuente original de la página.
Privacidad y tratamiento de datos
El funcionamiento del Comprobador de etiqueta canónica respeta la privacidad de las consultas. BroBroGo recibe la URL introducida con el único propósito de realizar la petición técnica y obtener la página pública. Ni el documento HTML obtenido durante la consulta ni los resultados del análisis se almacenan en ningún servidor.
Preguntas frecuentes
¿Qué es una etiqueta canónica autorreferente?
Es una etiqueta canónica que apunta a la URL final de la propia página. Así deja clara la dirección preferida para los buscadores aunque el mismo contenido se abra desde varias URL.
¿Por qué puede ser autorreferente y no coincidir con la URL introducida?
La dirección introducida puede redirigir a otra URL. La etiqueta canónica puede apuntar correctamente a esa página final y, por tanto, ser distinta de la dirección original.
¿Detecta las etiquetas canónicas añadidas con JavaScript?
El comprobador revisa el HTML que devuelve la página. Una etiqueta canónica añadida solo después de ejecutar scripts puede no aparecer; conviene incluir las etiquetas importantes en el código fuente original.