URL canónicas y meta robots
Controle el rastreo y evite contenido duplicado con etiquetas meta
URL canónicas y meta robots es una lección gratuita de HTML Academy en CoddyKit. Esta es la lección 3 de 4. Puedes leer la lección completa abajo gratuitamente — luego la practicas en el navegador con un editor de código integrado y un tutor de IA 24/7. Forma parte de la ruta de aprendizaje de HTML Academy, y tu progreso se sincroniza en la web y la app de CoddyKit. El curso de HTML Academy incluye 4 lecciones en total.
Problema del contenido duplicado
Los motores de búsqueda pueden encontrar su página en varias URL:
http://example.com/pagehttps://example.com/pagehttps://www.example.com/pagehttps://example.com/page/(barra final)https://example.com/page?utm_source=newsletter
Google debe decidir qué URL indexar y podría penalizar el contenido duplicado.
La etiqueta link canonical
Indique a los motores de búsqueda la URL preferida con rel="canonical":
<head>
<!-- This is the canonical URL for this content: -->
<link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->Reglas para la URL canonical
Buenas prácticas para las URL canonical:
- Use la URL absoluta y completa (incluido el protocolo)
- Use HTTPS si su sitio lo admite
- Sea coherente: use siempre la barra final o no la use nunca
- Cada página debe tener una etiqueta canonical, incluso si apunta a su propia URL
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->Paginación y canonical
En contenido paginado, canonical puede apuntar a la primera página o a la propia página:
<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->Valores de meta robots
Controle el comportamiento de los motores de búsqueda en cada página:
<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->
<meta name="robots" content="noindex">
<!-- Don't index this page -->
<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->
<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->
<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->Directivas específicas para Googlebot
Diríjase a rastreadores específicos con directivas específicas:
<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->
<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->
<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->
<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->Cabecera HTTP X-Robots-Tag
canonical y robots también pueden establecerse mediante cabeceras HTTP (a nivel del servidor):
# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"
# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tagsrobots.txt frente a meta robots
Dos herramientas para controlar los rastreadores, con propósitos diferentes:
- robots.txt — controla a qué páginas pueden acceder los rastreadores (control de acceso)
- meta robots — controla qué hacen los rastreadores con las páginas a las que han accedido (control de indexación)
Una página bloqueada en robots.txt aún puede indexarse si está enlazada desde otro lugar. Una página con noindex no se indexará.
Sitemap y canonical
Su sitemap solo debe incluir URL canonical:
<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->Canonical autorreferente
Cada página debe tener un canonical autorreferente, incluso la principal:
<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->Canonical en comercio electrónico
Patrones de canonical en comercio electrónico para productos con variantes:
<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->Comprobación rápida
¿Cuál debe ser el valor de href en una etiqueta link canonical?
Recapitulación: canonical y robots
Aspectos esenciales de canonical y robots:
<link rel="canonical" href="full-url">— declara la URL preferida- Use URL absolutas en canonical; use siempre HTTPS
meta robots noindex— excluye la página del índice de búsquedameta robots nofollow— no sigue los enlaces- robots.txt = control de acceso; meta robots = control de indexación
Aprende HTML con un tutor de IA — gratis
Escribe y ejecuta código real en tu navegador, obtén ayuda instantánea de un tutor de IA disponible 24/7 y continúa donde lo dejaste en la web o en la aplicación.
- Cursos
- 40
- Lecciones
- 159
Preguntas frecuentes
¿La lección «URL canónicas y meta robots» es gratis?
Sí — el texto completo de «URL canónicas y meta robots» es gratis para leer aquí en la web. Para practicarla de forma interactiva (editor de código integrado y tutor de IA 24/7) y desbloquear el resto del curso de HTML Academy, actualiza a CoddyKit PRO. El curso de HTML Academy incluye 4 lecciones en total.
¿Qué aprenderé en «URL canónicas y meta robots»?
Controle el rastreo y evite contenido duplicado con etiquetas meta Practicas HTML Academy con código real que ejecutas directamente en el navegador, y un tutor de IA 24/7 responde tus preguntas mientras trabajas en la lección.
¿Necesito experiencia previa para empezar HTML Academy?
No se requiere experiencia previa. HTML Academy en CoddyKit está estructurado para principiantes hasta estudiantes avanzados, así que puedes empezar aquí o desde el inicio y avanzar a tu ritmo. Esta es la lección 3 de 4.
¿Cuánto tiempo toma la lección «URL canónicas y meta robots»?
La mayoría de las lecciones de CoddyKit toman alrededor de 5–10 minutos. Cada una es compacta e interactiva, así que avanzas constantemente y retomas exactamente por donde dejaste en la web y la app.
¿Puedo escribir y ejecutar código en esta lección de HTML Academy?
Sí. Cada lección de HTML Academy incluye un editor de código integrado, así que escribes y ejecutas código real directamente en tu navegador y obtienes retroalimentación instantánea de IA — sin configuración local necesaria.
Todas las lecciones de este curso
- title y su función en SEO
- meta charset viewport author y description
- URL canónicas y meta robots
- Favicon y Apple Touch Icon