Google sobre o impacto de SEO de URLs injetados em HTML por plataformas CMS

Google sobre o impacto de SEO de URLs injetados em HTML por plataformas CMS


John Mueller, do Google, respondeu a uma pergunta no Reddit sobre um link para uma página interna que foi criada automaticamente pelo Squarespace, uma plataforma de código fechado. O link para a página da web também foi bloqueado para rastreamento pelo robots.txt, aparentemente não servindo a nenhum propósito para o cliente do Redditor. A pessoa que fez a pergunta ficou frustrada porque o CMS não permitiu a edição para remover o link e estava preocupada com os problemas de SEO causados ​​por esse link interno não autorizado.

Pergunta sobre um URL interno gerado automaticamente

Um SEO postou sobre esse problema no Reddit enquanto tentava consertar problemas técnicos para seu cliente, incluindo a remoção de um link para uma página da web que o cliente não havia criado intencionalmente e que foi gerada automaticamente pela plataforma, que não permitia a edição para remover o link.

Embora o URL tenha sido bloqueado pelo robots.txt, o Screaming Frog ainda detectou links internos apontando para a página da web, levantando preocupações de que o Google seria capaz de encontrar links para a página da web.

Eles perguntaram:

“Oi pessoal-

Estou resolvendo alguns problemas de alta prioridade para meu cliente e tenho um último. Há um URL interno bloqueado pelo arquivo robots txt. Meu cliente usa Squarespace. A página bloqueada não foi criada pelo cliente, mas parece ser um spin-off do squarespace semelhante a:

https://domínio/categorias/=59487a4cd1758e7669102174

O interessante é que usando o Screaming Frog, consigo encontrar os links para a página, mas eles estão escondidos em um href. Encontrei-o através das ferramentas do desenvolvedor, mas não tenho ideia de como excluir o link, pois o SS não dá acesso ao back-end.

O que diabos está acontecendo e como resolvo?”

Links aparentemente aleatórios gerados pela plataforma não afetarão o SEO

John Mueller, do Google, respondeu que o URL e os links que apontam não são um problema de visibilidade de pesquisa. Ele recomendou ignorar os links.

Muller explicou:

“Isso realmente não importa. Eu ignoraria. Não tem nenhum impacto na pesquisa/SEO.

Algumas plataformas só possuem links assim, se não houver nada por trás do link que você deseja indexar, não há nada que você precise fazer. (E possivelmente, pode não haver nada que você possa fazer se estiver em uma plataforma hospedada.)”

O que realmente são esses links do Squarespace

As plataformas CMS hospedadas controlam os modelos subjacentes, os sistemas de roteamento e o processo de renderização de JavaScript. É por isso que URLs no Squarespace, como aquela sinalizada pelo usuário, não podem ser editadas porque fazem parte da arquitetura interna do site.

Esse URL é provavelmente o identificador de URL interno do Squarespace em seu banco de dados. Então, em vez de referenciar uma URL desta forma, categoria=sapatos, ela faz referência a ela com o identificador interno do banco de dados desta maneira:

59487a4cd1758e7669102174

O truque ?format=json-pretty

Para ver os IDs de banco de dados subjacentes de qualquer site hospedado no Squarespace, basta adicionar ?format=json-pretty ao final de qualquer URL e o Squarespace interromperá a renderização da página visual da web e gerará o código formatado em JSON para essa página da web específica. Este é um truque que os desenvolvedores do Squarespace usam.

Captura de tela da saída ?format=json-pretty

Essa maneira de fazer as coisas faz sentido porque o sistema CMS pode usar um identificador canônico interno para um URL de categoria, e os usuários podem alterá-lo para o que quiserem que o URL seja. Portanto, não importa qual seja o nome da categoria que o usuário escolha, mesmo que mude de ideia, o identificador interno do banco de dados permanece o mesmo.

Sem conhecer essa informação, pode parecer para alguém de fora uma instância de um CMS de código fechado que restringe a liberdade do usuário, algo que o WordPress aparentemente não faz. No entanto, a realidade é que o Squarespace está proporcionando ao usuário liberdade absoluta para nomear suas categorias como quiserem, e esses URLs não editáveis ​​têm um propósito para que isso aconteça.

O WordPress também faz algo semelhante com identificadores internos, só que está mais oculto. O WordPress usa um term_id para categorias e tags, um post_id para postagens, produtos, páginas e anexos. Às vezes, você pode ver esses term_id e post_id no HTML bruto que o WordPress gera quando você olha o código-fonte e, assim como acontece com os agora não mais misteriosos URLs do Squarespace, não há nada que precise ser editado ou removido para fins de SEO.

Auditorias técnicas de SEO, incluindo rastreamentos com Screaming Frog, podem revelar alguns artefatos de aparência estranha que deveriam estar lá. Saber como funciona um CMS ajuda o SEO e o proprietário do site a entender se algo estranho é realmente estranho e se é algo 100% normal. Especialmente ao trabalhar com um CMS que você não conhece bem, é importante não fazer alterações para fins de SEO antes de saber como funciona o CMS subjacente. Muitas vezes, o que não é bem compreendido é, na verdade, algo que é seguro deixar de lado, como sugeriu John Mueller, do Google.

Quanto à configuração do Screaming Frog para rastrear um site do Squarespace, pode ser útil configurá-lo para obedecer ao Robots.txt ou até mesmo ajustá-lo manualmente para impedir que determinadas páginas sejam rastreadas.

Imagem em destaque por Shutterstock/xpixel



Source link

Postagens Similares

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *