Divulgação: este artigo contém links de afiliados. Se você assinar através deles, podemos receber uma comissão sem nenhum custo adicional para você.

Você provavelmente já se deparou bastante com o termo conteúdo duplicado, mas o que é isso exatamente? Conteúdo duplicado é o conteúdo que existe em vários lugares — ou seja, em várias URLs. Ele pode prejudicar o seu ranqueamento, e muita gente diz que grandes quantidades dele podem até gerar uma penalidade do Google. Só que isso não é verdade. Não existe penalidade, mas ter muito conteúdo duplicado ou copiado pode fazer o Google influenciar negativamente as suas posições.

Resposta rápida: o que é conteúdo duplicado?

Conteúdo duplicado é qualquer conteúdo disponível em mais de uma URL, dentro ou fora do seu site. Ele quase sempre surge por motivos técnicos (www e não-www, HTTP e HTTPS, parâmetros de URL) e não gera penalidade — mas confunde o Google na hora de escolher qual versão ranquear. A solução principal é a tag rel=”canonical”.

O que é conteúdo duplicado?

Conteúdo duplicado é todo conteúdo que está disponível em múltiplos lugares, dentro ou fora do seu site. Ele costuma viver em uma URL diferente e, às vezes, até em um domínio diferente. Na maior parte dos casos acontece por acidente ou é resultado de uma implementação técnica malfeita. Por exemplo: o seu site pode estar disponível tanto em www quanto sem www, ou em HTTP e HTTPS — ou os dois ao mesmo tempo, um horror! Ou talvez o seu CMS use parâmetros dinâmicos de URL em excesso, o que confunde os buscadores. Está em todo lugar.

A definição de conteúdo duplicado do Google é a seguinte:

“Conteúdo duplicado geralmente se refere a blocos substanciais de conteúdo, dentro de um domínio ou entre domínios, que correspondem completamente a outro conteúdo ou são consideravelmente semelhantes. Na maior parte das vezes, isso não tem origem enganosa.”

Essa última parte é importante. Se você raspa, copia e reescreve conteúdo existente — o Google chama isso de conteúdo copiado — com a intenção de enganar o buscador para conseguir uma posição melhor, você estará pisando em terreno perigoso.

O Google diz que esse tipo de intenção maliciosa pode disparar uma ação:

“Conteúdo duplicado em um site não é motivo para ação contra esse site, a menos que pareça que a intenção do conteúdo duplicado seja enganar e manipular os resultados do buscador.”

Conteúdo duplicado, copiado e raso: qual a diferença?

O tema do conteúdo duplicado confunde muita gente. Para o Google, ele tem majoritariamente uma origem técnica, mas o buscador também olha para o conteúdo em si: “Tenho duas URLs para o mesmo artigo, qual devo escolher?” Já a maioria das pessoas comuns provavelmente pensa em trechos de conteúdo parecido que aparecem em outros lugares do site: “Usei este trecho de texto em vários outros lugares, isso é ruim?” Tudo isso é conteúdo duplicado, mas, para determinar posições, os buscadores fazem distinção entre conteúdo duplicado, conteúdo copiado e conteúdo raso (thin content).

O seu conteúdo duplicado pode ser classificado como conteúdo copiado se você pegar um texto existente e reescrevê-lo às pressas para reutilizar no seu site. Não importa se você deu uma repaginada ou inseriu algumas palavras-chave: esse comportamento não é aceitável. Junte a isso algumas páginas de conteúdo raso — páginas com pouco ou nenhum conteúdo de qualidade — e você estará em território perigoso. A qualidade do site é um fator relevante, e essas táticas podem trazer prejuízos sérios. Lembra do Panda?

Não bloqueie o conteúdo duplicado no seu site

O Google é bastante competente em descobrir e lidar com conteúdo duplicado. O buscador é inteligente o suficiente para decidir o que fazer com a maior parte do conteúdo que encontra. Se ele encontra múltiplas versões de uma página, agrupa todas na versão que considera melhor — na maioria dos casos, o artigo ou a página original. O que ele precisa, porém, é de acesso completo a essas URLs. Se você bloqueia o Googlebot no seu robots.txt e impede o rastreamento dessas URLs, ele não consegue resolver isso sozinho e você corre o risco de o Google tratar essas páginas como instâncias separadas. Aqui está o que você deve fazer:

  • Permita que os robôs rastreiem essas URLs
  • Marque o conteúdo como duplicado usando rel=canonical (veja mais abaixo)
  • Defina no Google Search Console como os parâmetros de URL devem ser tratados
  • Use redirecionamentos 301 para enviar usuários e rastreadores à URL canônica

Use rel=canonical!

Uma das ferramentas essenciais no seu kit de combate ao conteúdo duplicado é o rel=”canonical”. Você pode usar esse trecho de código para determinar qual é a URL original de um conteúdo — o que chamamos de URL canônica. Plugins de SEO já preenchem essa tag automaticamente na maioria dos casos, mas vale conferir as páginas que você criou manualmente.

Foque em conteúdo original, atual e com autoridade

Outra ferramenta no seu arsenal contra conteúdo duplicado, copiado e pouco original é a sua própria escrita. O Google é focado em qualidade. Ele está sempre atrás do melhor conteúdo possível, aquele que atende melhor à intenção do usuário. O seu objetivo não deve ser ganhar um dinheiro rápido, e sim deixar uma impressão duradoura. Fique de olho no conteúdo raso e garanta que o seu material seja original e de alta qualidade.

O mesmo vale para conteúdo parecido dentro do seu site. Já falamos sobre canibalização de palavras-chave, e este é um desdobramento disso. Fundir vários posts comparáveis em um só pode trazer resultados muito melhores, tanto em termos de ranqueamento quanto no combate ao conteúdo duplicado. Uma auditoria de site com a Semrush facilita muito esse diagnóstico: ela aponta páginas com conteúdo duplicado, títulos e meta descriptions repetidos e casos de canibalização, listando exatamente quais URLs precisam de canonical, redirecionamento ou fusão.

Veja o que o Google diz sobre conteúdo parecido:

“Minimize o conteúdo semelhante: se você tem muitas páginas parecidas, considere expandir cada página ou consolidá-las em uma só. Por exemplo, se você tem um site de viagens com páginas separadas para duas cidades, mas com a mesma informação nas duas, pode fundir as páginas em uma única sobre as duas cidades ou expandir cada página para conter conteúdo exclusivo sobre cada uma.”

Conteúdo duplicado está em todo lugar — saiba o que fazer

O ex-Googler Matt Cutts disse, em uma frase que ficou famosa, que de 20% a 30% da web consiste em conteúdo duplicado. Embora não dê para garantir que esses números continuem precisos, o conteúdo duplicado segue aparecendo em todo site. Isso não precisa ser uma má notícia. Corrija o que puder e não tente transformar conteúdo duplicado — nem os seus primos, o conteúdo copiado e o conteúdo raso — em uma estratégia de SEO.

Perguntas frequentes

Conteúdo duplicado gera penalidade do Google?

Não. Não existe penalidade automática por conteúdo duplicado. O Google apenas escolhe uma versão para ranquear. A penalidade só entra em cena quando há intenção clara de enganar o buscador com conteúdo copiado.

Como corrigir conteúdo duplicado no meu site?

Use a tag rel=”canonical” apontando para a versão original, aplique redirecionamentos 301 quando a página duplicada não for mais necessária e consolide páginas muito parecidas em uma única página mais completa.

Devo bloquear páginas duplicadas no robots.txt?

Não. Bloquear o rastreamento impede o Google de entender que as páginas são versões da mesma coisa. Deixe que ele rastreie e sinalize a versão correta com canonical ou redirecionamento.

Qual a diferença entre conteúdo duplicado e conteúdo raso?

Conteúdo duplicado é o mesmo conteúdo em várias URLs. Conteúdo raso é uma página com pouco ou nenhum valor real para o leitor. Os dois prejudicam a percepção de qualidade do site, mas por motivos diferentes.

Deixe uma resposta

This site uses Akismet to reduce spam. Learn how your comment data is processed.