URLs canônicas e meta robots
Controle o rastreamento e evite conteúdo duplicado com meta tags.
URLs canônicas e meta robots é uma aula grátis de HTML Academy no CoddyKit. Esta é a aula 3 de 4. Você pode ler a aula completa abaixo gratuitamente — depois pratica ao vivo no navegador com um editor de código integrado e um tutor de IA 24/7. Faz parte do caminho de aprendizado de HTML Academy, e seu progresso é sincronizado entre a web e o app CoddyKit. O curso de HTML Academy inclui 4 aulas no total.
Problema do conteúdo duplicado
Os mecanismos de pesquisa podem encontrar sua página em vários URLs:
http://example.com/pagehttps://example.com/pagehttps://www.example.com/pagehttps://example.com/page/(barra final)https://example.com/page?utm_source=newsletter
O Google precisa decidir qual URL indexar — e pode penalizar o conteúdo duplicado.
A tag de link canônico
Informe aos mecanismos de pesquisa o URL preferencial com rel="canonical":
<head>
<!-- This is the canonical URL for this content: -->
<link rel="canonical" href="https://example.com/blog/html5-guide">
</head>
<!-- No matter which URL the page is accessed from,
this tag signals to Google which URL to index -->
<!-- Link equity is consolidated at the canonical URL -->Regras para URLs canônicas
Práticas recomendadas para URLs canônicas:
- Use o URL absoluto e completo (incluindo o protocolo)
- Use HTTPS se o site oferecer suporte
- Seja consistente: use sempre a barra final ou nunca a use
- Toda página deve ter uma tag canônica — mesmo quando o URL é o da própria página
<link rel="canonical" href="https://example.com/blog/html5-guide">
<!-- NOT: -->
<!-- <link rel="canonical" href="/blog/html5-guide"> relative = bad -->
<!-- <link rel="canonical" href="http://..."> HTTP on HTTPS site = bad -->Paginação e URL canônico
Para conteúdo paginado, o URL canônico pode apontar para a primeira página ou para a própria página:
<!-- Page 2 of a blog listing: -->
<link rel="canonical" href="https://example.com/blog?page=2">
<!-- Or: consolidate all pages to the first -->
<link rel="canonical" href="https://example.com/blog">
<!-- Also useful: rel="prev" and rel="next" for paginated series -->Valores de robôs nos metadados
Controle o comportamento dos mecanismos de pesquisa por página:
<meta name="robots" content="index, follow">
<!-- Default: include in index and follow links -->
<meta name="robots" content="noindex">
<!-- Don't index this page -->
<meta name="robots" content="nofollow">
<!-- Don't follow links on this page -->
<meta name="robots" content="noindex, nofollow">
<!-- Don't index AND don't follow -->
<meta name="robots" content="noarchive">
<!-- Don't show cached version in search results -->Diretivas específicas para o Googlebot
Direcione rastreadores específicos com diretivas específicas:
<meta name="googlebot" content="noindex">
<!-- Only affects Google's crawler -->
<meta name="bingbot" content="noindex">
<!-- Only affects Bing's crawler -->
<!-- Other values: -->
<meta name="robots" content="max-snippet:50">
<!-- Limit snippet length in search results to 50 characters -->
<meta name="robots" content="max-image-preview:large">
<!-- Allow full-size image previews in Google results -->Cabeçalho HTTP X-Robots-Tag
O URL canônico e as diretivas para robôs também podem ser definidos por meio de cabeçalhos HTTP (no nível do servidor):
# Apache .htaccess:
Header add Link "<https://example.com/page>; rel=canonical"
Header add X-Robots-Tag "noindex"
# This is more powerful because it applies to non-HTML files too
# (PDFs, images, etc.) which can't have meta tagsrobots.txt versus robôs nos metadados
Duas ferramentas para controlar rastreadores — com finalidades diferentes:
- robots.txt — controla quais páginas os rastreadores podem acessar (controle de acesso)
- robôs nos metadados — controla o que os rastreadores fazem com as páginas que acessaram (controle de indexação)
Uma página proibida em robots.txt ainda pode ser indexada se houver um link para ela em outro lugar. Uma página com noindex certamente não será indexada.
Mapa do site e URL canônico
Seu mapa do site deve listar apenas URLs canônicos:
<!-- sitemap.xml should list canonical URLs only: -->
<!-- https://example.com/blog/html5-guide (canonical) -->
<!-- NOT: https://www.example.com/blog/html5-guide -->
<!-- NOT: https://example.com/blog/html5-guide/ (trailing slash variant) -->URL canônico autorreferente
Toda página deve ter um URL canônico autorreferente — até mesmo a página principal:
<!-- On https://example.com/about (the canonical URL itself): -->
<link rel="canonical" href="https://example.com/about">
<!-- This confirms: this IS the canonical URL -->
<!-- Prevents issues if the page is embedded in an iframe or scraped -->URL canônico no comércio eletrônico
Padrões de URLs canônicos no comércio eletrônico para produtos com variantes:
<!-- Product page with color filter: -->
<!-- URL: /products/widget?color=blue -->
<link rel="canonical" href="https://example.com/products/widget">
<!-- All color variants point to the main product page -->
<!-- Avoids duplicate content penalty for parameter variants -->Verificação rápida
Qual deve ser o valor de href em uma tag de link canônico?
Recapitulação: URLs canônicos e robôs
Elementos essenciais de URLs canônicos e robôs:
<link rel="canonical" href="full-url">— declara o URL preferencial- Use URLs absolutos no URL canônico; sempre HTTPS
meta robots noindex— exclui do índice de pesquisameta robots nofollow— não segue os links- robots.txt = controle de acesso; robôs nos metadados = controle de indexação
Aprenda HTML com um tutor de IA — grátis
Escreva e execute código real no seu navegador, obtenha ajuda instantânea de um tutor de IA 24/7 e continue de onde parou na web ou no app.
- Cursos
- 40
- Aulas
- 159
Perguntas Frequentes
A aula “URLs canônicas e meta robots” é grátis?
Sim — o texto completo de “URLs canônicas e meta robots” é grátis para ler aqui na web. Para praticá-la interativamente (um editor de código integrado e um tutor de IA 24/7) e desbloquear o restante do curso de HTML Academy, atualize para CoddyKit PRO. O curso de HTML Academy inclui 4 aulas no total.
O que vou aprender em “URLs canônicas e meta robots”?
Controle o rastreamento e evite conteúdo duplicado com meta tags. Você pratica HTML Academy com código prático que executa diretamente no navegador, e um tutor de IA 24/7 responde suas dúvidas enquanto trabalha na aula.
Preciso ter experiência prévia para começar HTML Academy?
Nenhuma experiência prévia é necessária. HTML Academy no CoddyKit é estruturado para alunos iniciantes até avançados, então você pode começar aqui ou desde o início e aprender no seu ritmo. Esta é a aula 3 de 4.
Quanto tempo leva a aula “URLs canônicas e meta robots”?
A maioria das aulas CoddyKit leva cerca de 5–10 minutos. Cada uma é compacta e interativa, então você faz progresso constante e retoma exatamente de onde parou entre web e app.
Posso escrever e executar código nesta aula de HTML Academy?
Sim. Cada aula de HTML Academy inclui um editor de código integrado, então você escreve e executa código real direto no navegador e recebe feedback de IA instantaneamente — nenhuma configuração local necessária.
Todas as aulas deste curso
- title e seu papel no SEO
- meta charset viewport author e description
- URLs canônicas e meta robots
- Favicon e ícone Apple Touch