Etiquetas Canonical: guía simple para principiantes |
¿Deseas aprender qué son las etiquetas canonical y cómo emplearlas para evitar los temidos problemas de contenido copiado?
Las etiquetas canonical no son nada nuevo. Han estado por ahí.
Google, Microsoft y Yahoo se unieron para crearlas. ¿Su objetivo? Suministrar a los dueños de sitios una forma de solucionar los inconvenientes de contenido copiado de forma rápida y sencilla.
¿Funcionan? Sí, perfectamente… ¡pero sólo si sabes cómo utilizarlas!
En esta guía, aprenderás:
Una etiqueta canonical (rel=“canonical”) es un fragmento de código HTML que define la versión principal para páginas duplicadas, prácticamente duplicadas y similares. En otras palabras, si tienes el mismo (o bien similar) contenido libre en diferentes URLs, puedes utilizar etiquetas canonical para detallar qué versión es la principal y en consecuencia, la que debería ser indizada.
Las etiquetas canonical emplean una sintaxis simple y consistente, y se sitúan dentro de la sección <head> de una página web:
<link rel=“canonical” href=“/pagina-ejemplo/” />
Esto es lo que significa cada una parte de ese código:
A Google no le agrada el contenido duplicado. Hace que sea más difícil para ellos elegir:
Demasiado contenido copiado también puede afectar a tu “crawl budget”. Esto quiere decir que Google puede terminar perdiendo el tiempo rastreando múltiples versiones de la misma página en lugar de descubrir otro contenido importante en tu sitio.
La verdad sobre el crawl budget
Obligar a Google a perder el tiempo rastreando contenido duplicado es por supuesto algo que debe evitarse en lo posible. No obstante, Google afirma que no es un inconveniente para la mayoría de los sitios.
Si las nuevas páginas tienden a ser rastreadas el mismo día de su publicación, el crawl budget no es algo en lo que los administradores web deban centrarse. De igual manera, si un sitio tiene menos de unas pocas miles y miles de URLs, la mayoría de las veces se rastreará de forma eficiente.
Las etiquetas canonical resuelven todos estos problemas. Permiten señalar a Google qué versión de una página deben indexar y posicionar, y dónde afianzar “link equity”.
Si no se especifica una URL canonical, Google se encargará de estos asuntos .
Si no señalas una URL canonical, identificaremos lo que creemos que es la mejor versión o bien URL.
Confiar en Google de esta forma no es una enorme idea; es posible que seleccionen una versión de tu página que no quieras que sea canonical.
Google que generalmente respetan la URL canonical que configuras, mas no siempre y en toda circunstancia. Esto es porque las etiquetas canonical son pistas, no directivas. Siempre y cuando se respeten, cualquier señal como los links, deberían afianzarse en la URL canonical.
Ejecutar buenas prácticas de etiquetas canonical también ayuda a atenuar el peligro de que Google vea una versión no deseada de la página como canonical.
Dado que seguramente no has estado publicando las mismas entradas y páginas varias veces, es fácil aceptar que tu sitio no tiene contenido copiado.
Pero los motores de búsqueda rastrean las URLs, no las páginas web.
Esto quiere decir que ven
ejemplo.com/producto y
ejemplo.com/producto?color=red como páginas únicas, si bien sean exactamente la misma página web con contenido idéntico o bien similar.
Se denominan URLs parametrizadas y son una causa común de contenido duplicado, singularmente en sitios de con navegación facetada/filtrada.
Por ejemplo,
Brown Bag Clothing vende camisetas. Esta es la URL para su:
/en-gb/clothing/shirts.html
Si filtras sólo para camisetas XL, se añade un parámetro a la URL:
/en-gb/clothing/shirts.html
?Size=XL
Si entonces también aplicas el filtro sólo para camisetas azules, se añade otro parámetro:
/en-gb/clothing/shirts.html
?Size=XL&color=Blue
Todas estas son páginas separadas a los ojos de Google, si bien el contenido sea sólo marginalmente diferente.
Pero no son sólo los sitios de comercio electrónico los que caen víctimas de contenido copiado.
Aquí hay otras causas comunes de contenido duplicado que se aplican a todos los tipos de sitios web:
En estas situaciones, el empleo conveniente de las etiquetas canonical es crucial.
Además, los problemas de contenido duplicado entre dominios cruzados también son un inconveniente. Si estás sindicando contenido, la mejor práctica es usar una etiqueta canonical autorreferencial en tu artículo y hacer que el contenido sindicado señale tu versión como la canonical con una etiqueta canonical de un dominio a otro.
Esto no siempre y en toda circunstancia impide que el contenido sindicado aparezca en los resultados de búsqueda, mas ayuda a reducir el riesgo de superar a la original.
(Si la gente escoge de manera deliberada sindicar su contenido, se hace difícil identificar la fuente de origen. De ahí que aconsejamos el empleo de canonicals o bien el bloqueo. Los editores pueden demandarlo).
Algunos sitios se negarán a añadir un enlace canonical. En tales casos, depende de ti si quieres correr el riesgo.
Las etiquetas canonical son fáciles de incorporar. Discutiremos cuatro formas diferentes de hacerlo en un instante. No importa el método que elijas, hay cinco reglas de oro que deberías recordar en todo instante.
John Mueller de Google afirma que es buena práctica no emplear caminos relativos con el elemento de link rel=“canonical”.
(Puedes utilizar cualquiera de los dos, pero te recomiendo que uses las URLs absolutas a fin de que estés seguro de que se interpretan adecuadamente).
Así que deberías emplear la próxima estructura:
<link rel=“canonical” href=“
/ejemplo-pagina/” />
Al contrario de:
<link rel=“canonical” href=”
/ejemplo-pagina/” />
Dado que Google puede tratar las URLs en mayúsculas y en minúsculas como dos URL diferentes, primero debes asegurarte de y luego usar URLs en minúsculas para tus etiquetas canonical.
Si has alterado a SSL, asegúrate de no declarar ninguna URL no-SSL (o sea, HTTP) en tus etiquetas canonical. Hacerlo puede teóricamente llevar a confusión y a resultados inopinados. Si estás en un dominio seguro, asegúrate de emplear la siguiente versión de tu URL:
<link rel=“canonical” href=“
https://ejemplo.com/ejemplo-pagina/” />
Al contrario de:
<link rel=“canonical” href=“
http://ejemplo.com/ejemplo-pagina/” />
Si no estás utilizando HTTPS entonces haz lo opuesto.
John Mueller de Google afirma que aunque no es obligatorio, las etiquetas canonical autorreferenciales son.
Recomiendo [usar una] canonical autorreferencial por el hecho de que realmente nos deja en claro qué página quieres que se indexe, o bien cuál debería ser la URL cuando se indexe.
Incluso si tienes una página, en ocasiones hay diferentes variaciones de URLs que pueden hacer que esa página cambie. Por servirnos de un ejemplo, con parámetros al final, quizás con mayúsculas y minúsculas o www y no www. Todas estas cosas pueden ser solucionadas con una etiqueta canonical.
En en el caso de que no estés seguro de cómo marcha una canonical autorreferencial, se trata básicamente de una etiqueta canonical en una página que apunta a sí misma. Por poner un ejemplo, si la URL fuera
/ejemplo-pagina, entonces una canonical autorreferencial en esa página sería:
<link rel=“canonical” href=“/ejemplo-pagina” />
La mayoría de los CMS modernos y populares añaden automáticamente URLs autorreferenciales, pero necesitarás que tu desarrollador lo codifique si utilizas un Content Management System adaptado.
Si una página tiene múltiples etiquetas canonical,.
En en el caso de que haya varias declaraciones de rel=canonical, es probable que Google ignore todos esos indicios de rel=canonical.
Hay cinco formas conocidas de precisar URLs canonical. Estas son las llamadas señales de canonicalización:
Para inconvenientes y ventajas de cada método, mira la.
El empleo de una etiqueta rel=canonical es la manera más simple y obvia de precisar una URL canonical.
Simplemente añade el próximo código a la sección <head> de cualquier página duplicada
<link rel=“canonical” href=“/pagina-canonical/” />
Digamos que tienes un sitio web de ecommerce de venta de camisetas. Deseas que
/camisetas/camisetas-negras/ sea la URL canonical, aún cuando el contenido de esa página sea alcanzable a través de otras URLs (por servirnos de un ejemplo,
/ofertas/camisetas-negras/)
Simplemente añade la próxima etiqueta canonical a cualquier página duplicada:
<link rel=“canonical” href=“/camisetas/camisetas-negras/” />
Ten en cuenta que si estás utilizando un CMS, no es necesario que te metas con el código de tu página. Hay una forma más fácil.
Instala y las etiquetas canonical autorreferenciales se añadirán automáticamente. Para establecer canonicals adaptados usa la sección “Avanzado” en cada blog post o bien página.
Shopify añade de forma predeterminada URLs canonical autorreferenciales para productos y publicaciones de weblog. Para establecer URLs canonical personalizadas necesitarás editar los archivos de la plantilla (.liquid) de forma directa.
tiene algo de información sobre cómo hacerlo.
Squarespace añade también, por defecto, URLs autorreferenciales. Pero, como en el caso de Shopify, necesitas editar el código de forma directa si deseas añadir una URL canonical adaptada.
Para documentos como PDFs no hay manera de colocar etiquetas canonical en la cabecera de una página pues no hay una sección <head> en una página. En semejantes casos, necesitarás utilizar el HTTP header para establecer las canonicals. Puedes también utilizar una canonical en HTTP header de páginas web estándar.
Imagina que creamos una versión PDF de este artículo y lo ubicamos en una subcarpeta de nuestro blog (ahrefs.com/blog/*).
Así es cómo se vería nuestra cabecera HTTP para ese archivo:
Content-Type: application/pdf
Link: </blog/canonical-tags/>; rel=“canonical”
Lectura recomendada
:
(en inglés)
Google que las páginas no-canonical
no deberían ser incluidas en sitemaps. Sólo las URLs canonical deberían estar catalogadas. Esto es así por el hecho de que Google entiende a las páginas catalogadas en el sitemap como canonicals sugeridas.
De todas formas. No siempre y en todo momento seleccionarán URLs en sitemaps como canonicals.
No garantizamos que consideremos a las URLs de los sitemaps como canonicals, mas es una forma sencilla de definirlas para un lugar grande, y los sitemaps son una forma útil de indicar a Google qué páginas consideras más importantes en tu sitio.
Utiliza redirecciones trescientos uno cuando quieras desviar el tráfico de una URL duplicada y cara la versión canonical.
Supón que se puede acceder a tu página a través de estas URLs:
Elige una URL como la canonical y redirecciona las otras URLs hacia allí.
Deberías hacer lo mismo para asegurar las versiones HTTPS/HTTP y www/no-www de tu lugar. Elige una versión canonical y redirecciona las otras hacia ella.
Por ejemplo, la versión canonical de
ahrefs.com es la URL con HTTPS y no-www (
). Todas las próximas URLs redireccionan hacia allí:
Lee
.
La forma en que se enlaza de una página a otra a través de tu sitio es una señal de canonicalización.
El webmasters analista de tendencias de Google, John Mueller, cubre las señales usadas para determinar las URLs canonical en:
Cuanto más consistente seas con todas y cada una estas señales, más fácil será para los motores de búsqueda determinar tu URL canonical preferida. Tal como mienta John en el vídeo, Google también tiene preferencia por las URLs HTTPS sobre las HTTP, y por las URLs más bonitas.
La canonicalización es de alguna manera un tópico complejo. Como tal, existen muchos malentendidos y conceptos erróneos sobre cómo canonicalizar apropiadamente.
Aquí existen algunos errores comunes que la gente comete al tratar de hacerlo:
Bloquear una URL en impide que Google lo rastree, lo que quiere decir que no podrán ver ninguna etiqueta canonical en esa página. Esto, por su parte, impide que transfieran “link equity” de la página no-canonical a la canonical.
Nunca mezcles noindex y rel=canonical. Son instrucciones contradictorias.
Google suele dar prioridad a la etiqueta canonical sobre la etiqueta ‘noindex’, como afirma John Mueller. Mas prosigue siendo una mala práctica. Si no deseas indexar y al unísono canonicalizar una URL, emplea una redirección trescientos uno. En caso contrario, usa rel=canonical.
Establecer un código de estado HTTP 4XX para una URL canonicalizada tiene exactamente el mismo efecto que usar la etiqueta ‘noindex’: Google no podrá ver la etiqueta canonical y transferirá “link equity” a la versión canonical.
Las páginas paginadas no deben ser canonicalizadas a la primera página paginada de la serie. En su lugar, se deben usar canonicals autorreferenciales en todas las páginas paginadas.
¿Por qué? Como John Mueller de Google, este es un empleo inadecuado de la rel=canonical.
Ya que este post es sobre la canonicalización, lo principal que hay que eludir es utilizar rel=canonical en la página dos que apunta a la página 1. La página 2 no es equivalente a la página 1, con lo que el uso de rel=canonical así sería incorrecto.
También deberías usar etiquetas rel=prev/next para la paginación. Estas, mas.
se utilizan para concretar el idioma y el objetivo geográfico de una página web.
Google que cuando se diseño identidad corporativa hreflang, se debe “especificar una página canonical en exactamente el mismo idioma, o bien el mejor idioma sustituto posible si no existe una canonical para exactamente el mismo idioma”.
El hecho de tener múltiples etiquetas rel=canonicals hará que seguramente sean ignoradas por Google. Habitualmente esto ocurre pues las etiquetas se introducen en un sistema en diferentes puntos como por ejemplo por el Content Management System, el tema, y el/los plugin(s). Es por esto que muchos plugins tienen una opción de sobreescritura para asegurarse de que son la única fuente de etiquetas canonical.
Otra área en la que esto puede ser un inconveniente es en las canonicals añadidas con JavaScript. Si no tienes una URL canonical especificada en la respuesta HTML y luego añades una etiqueta rel=canonical con JavaScript entonces debería ser respetada cuando Google renderice la página. Sin embargo, si tienes una canonical concretada en código HTML y también intercambias la versión preferida con JavaScript, estás mandando señales confusas a Google.
Rel=canonical debería aparecer solo en la <head> de un documento. Una etiqueta canonical en la sección <body> de una página será ignorada.
Donde esto puede convertirse en un problema es con el análisis sintáctico de un documento. Al paso que el código fuente de una página puede tener la etiqueta rel=canonical en la ubicación adecuada, cuando la página se edifica verdaderamente en un navegador o se renderiza por un motor de búsqueda, muchas cosas distintas como etiquetas no cerradas, JavaScript inyectado, o bien <iframes> en la sección <head> pueden ocasionar que el <head> acabe prematuramente mientras se renderiza. En estos casos, una etiqueta canonical puede ser accidentariamente lanzada al <body> de una página renderizada donde no será respetada.
Es fácil cometer fallos con la canonicalización, por lo que merece la pena auditar regularmente tu sitio para los problemas relacionados con las etiquetas canonical y arreglarlos cuanto antes.
Para ello, puede emplear la.
Site Audit rastrea tu sitio web por más de 100 inconvenientes posicionamiento web en buscadores, incluyendo aquellos relacionados con las etiquetas canonical.
Aquí hay doce problemas relacionados con el etiquetado canonical que Site Audit puede hallar, y cómo arreglarlos:
Esta advertencia se activa en el momento en que una o bien más páginas son canonicalizadas a una URL 4XX.
Los motores de búsqueda no indexan páginas 4XX porque no funcionan. Como resultado, ignoran cualquier etiqueta canonical que apunte a tales páginas y frecuentemente acaban indexando la versión incorrecta (no canonical) de la página.
Revisa las páginas afectadas y reemplaza los enlaces canonicals fallecidos (4XX) por enlaces a páginas que funcionen (200) que desees indexar.
Esta advertencia se activa en el momento en que una o bien más páginas son canonicalizadas a una URL 5XX.
Los códigos de estado HTTP 5XX indican inconvenientes en el servidor, que dan como resultado una página canonical inaccesible. No es muy probable que Google indexe páginas inalcanzables, por lo que podría ignorar el código canonical.
Reemplazar cualquier URL canonical errónea con URL válidas. Verifica si hay configuraciones erróneas en el servidor si el canonical detallado semeja correcto. Ten en cuenta que esto puede ser un inconveniente temporal si el rastreo se generó cuando tu sitio se estaba caído por mantenimiento o bien el servidor de tu sitio estaba sobrecargado.
Esta advertencia se activa en el momento en que una o bien más páginas son canonicalizadas a una URL redireccionada.
Las canonicals deben siempre señalar la versión con mayor autoridad de una página. Este no es el caso con la redirección de URLs. palabras clave para seo , los motores de búsqueda pueden malinterpretar o ignorar la etiqueta.
Reemplazar los enlaces canonicals por links directos a la versión con mayor autoridad de la página (es decir, una que devuelva un código de estado HTTP 200 y no redireccione).
Esta advertencia se activa cuando existen una o bien más páginas duplicadas o muy afines que no especifican una versión canonical.
Dado que no se especifica ninguna canonical, Google intentará identificar la versión más adecuada para mostrarla en los propios resultados de búsqueda. Es posible que esta no sea la versión que quieres indexar.
Revisa los conjuntos de duplicados. Elige una versión canonical que debería ser indizada en los resultados de búsqueda. Especifica ésta como la versión canonical en todos los duplicados (y añade una etiqueta canonical autorreferencial a la versión canonical).
Esta advertencia se activa cuando una o más páginas detallan una URL no canonical en sus anotaciones de hreflang.
Los enlaces en las etiquetas hreflang
siempre deben apuntar a las páginas canonicals. Enlazar a una versión no-canonical de una página desde las anotaciones de hreflang puede confundir y despistar a los motores de búsqueda.
Sustituir los enlaces en las anotaciones de hreflang de las páginas afectadas por su canonical.
Esta advertencia se activa cuando una o bien más URLs canonical concretadas no tienen links entrantes internos.
Las URLs canonical sin enlaces internos son inaccesibles para los visitantes del sitio web. En algún sitio del lugar se las dirige a una versión no-canonical de la página en su lugar.
Reemplazar cualquier enlace interno a páginas canonicalizadas con enlaces directos a la canonical.
Esta advertencia se activa en el momento en que una o más páginas no-canonical aparecen en el sitemap.
Google establece que no debes incluir URLs no-canonical en tu sitemap; la razón es que ven las páginas de los sitemaps como sugerencias canonical. Sólo deberías incluir en los sitemaps las páginas que desees que se indexen.
Elimina URLs no-canonical de tu sitemap..
Esta advertencia se activa cuando una o bien más páginas especifican una URL canonical que también es canonicalizada a una página diferente. Esto crea una “cadena de canonicals” en la que la página A es canonicalizada a la página B, que por su parte es canonicalizada a la página C.
Las cadenas canonicals pueden confundir y engañar a los motores de búsqueda. Como resultado, pueden malinterpretar o bien ignorar sus especificaciones.
Sustituir los links no canonical en las etiquetas canonical de las páginas afectadas por links directos a la canonical. Por ejemplo, si la página A es canonicalizada a la página B, que por su parte es canonicalizada a la página C, reemplaza el enlace canonical de la página A por un link a la página C.
Esta advertencia se dispara cuando hay un desajuste entre la canonical concretada y la URL de Open Graph en una o bien más páginas.
Si la URL del Open Graph no coincide con la URL canonical, entonces se compartirá una versión no canonical de una página en redes sociales.
Reemplaza la URL de Open Graph en las páginas afectadas por la URL canonical. Asegúrate de que las dos URLs sean exactamente las mismas.
Las URLs en las etiquetas de Open Graph han de ser absolutas y utilizar los protocolos http:// o https://, como es el caso de las canonicals.
Esta advertencia se activa en el momento en que una o bien más páginas seguras (HTTPS) especifican una versión no segura (HTTP) como la canonical.
, con lo que tiene sentido concretar versiones seguras de las páginas como canonicals cuando sea posible.
Redirigir la página HTTP al equivalente HTTPS. Si no es posible, añade un enlace rel=“canonical” de la versión HTTP de la página a la HTTPS.
Esta advertencia se activa cuando una o bien más páginas no seguras (HTTP) detallan una versión segura (HTTPS) como la canonical.
Se prefiere HTTPS a HTTP. Tener una versión HTTP de una página y luego especificar la versión HTTPS como canonical es ilógico.
Es probable que esto no cause un gran inconveniente, mas merece la pena arreglarlo si es posible.
Implementar una redirección trescientos uno de HTTP a HTTPS. También deberías sustituir cualquier link interno a la versión HTTP de la página con links de manera directa a la versión HTTPS.
Esta advertencia se activa en el momento en que una o más páginas no-canonicals aparecen en los resultados de búsqueda y obtienen tráfico de búsqueda orgánico (lo que no debería acontecer).
O bien las etiquetas canonical están configuradas de forma incorrecta o bien Google ha optado por ignorar la canonical concretada.
Comprueba que las etiquetas rel=canonical estén configuradas correctamente en todas y cada una de las páginas reportadas. Si no es así, usa la herramienta de inspección de URL de Google Search Console para revisar si consideran que la URL canonical detallada es canonical realmente. Si hay una incompatibilidad, investiga por qué es así.
Las etiquetas canonical no son
tancomplicadas. Es difícil en un comienzo hasta el momento en que le encuentras la vuelta.
Sólo recuerda que las etiquetas canonical no son una directiva sino una señal para los motores de búsqueda. En otras palabras, podrían escoger una canonical diferente a la que has declarado.
Puedes utilizar la en Google Search Console para poder ver tanto la canonical declarada por el usuario como la seleccionada por Google.
Estas son las clasificaciones que Google emplea en su Informe del índice de cobertura de Google Search Console relacionadas con las URLs canonical:
¿Alguna pregunta? Déjala en los comentarios o bien escribeme.
Traducido por
. Desde Argentina, hacemos que te encuentren.
| Êîììåíòèðîâàòü | « Ïðåä. çàïèñü — Ê äíåâíèêó — Ñëåä. çàïèñü » | Ñòðàíèöû: [1] [Íîâûå] |