Por que a integridade de dados é o novo SEO técnico: do rastreamento à confiança

Por que a integridade de dados é o novo SEO técnico: do rastreamento à confiança


Nos últimos dois anos, o Google retirou o suporte para nove ItemTypes de sua galeria de pesquisa aprimorada. Isso aconteceu não muito tempo depois do lançamento do ChatGPT e quando a adoção em massa começou:

Resultados aprimorados suportados pela pesquisa do Google ao longo do tempo
Imagem do autor, julho de 2026

A questão permanece se esse declínio continuará, mas a remoção mais recente – FAQ/FAQPage – causou algum debate sobre o papel do schema.org no futuro da Pesquisa.

O esquema está morto, certo?

Embora alguns realizem testes e experimentos para entender se o esquema realmente causa um impacto positivo ao ser citado nas respostas da plataforma, Gianluca Fiorelli observou notavelmente que podemos estar realizando esses testes em conjuntos de dados limitados. Com isso em mente, vamos nos lembrar do texto da mensagem de suspensão de uso para pesquisas aprimoradas de perguntas frequentes:

“… Eliminaremos a aparência da pesquisa de perguntas frequentes, o relatório de pesquisa aprimorada e o suporte no teste de pesquisa aprimorada em junho de 2026.”

Observe aqui o que eles não mencionaram – que o uso do esquema FAQ não é mais necessário. Isso ocorre porque a descontinuação é apenas para resultados aprimorados – um recurso de exibição. O próprio esquema é uma camada de compreensão – identificando entidades e os relacionamentos entre elas. O esquema está morto? Na minha opinião, está longe disso. Embora algumas propriedades sejam obsoletas, outras, como Produto, são estendidas.

Dito isto, também estou ciente de que adicionar esquema não é uma solução mágica que contribui para o crescimento das citações. No entanto, esse crescimento vai além das métricas nas quais estamos acostumados, como citações, impressões, etc. Suganthan Mohanadasan escreveu um ótimo artigo sobre como o esquema tem três “vidas”:

  1. Pipeline de índice do Google.
  2. Pré-treinamento LLM (indireto).
  3. Recuperação de tempo de execução LLM.

Os SEOs têm sido historicamente focados no número 1 como algo que pode contribuir positivamente para as métricas de sucesso. Mas o esquema vai além do que estamos acostumados ou do que relatamos com precisão. O esquema não está morrendo; em vez disso, um recurso de exibição do qual ele se beneficiou está diminuindo.

A maior ameaça de um SEO: ambigüidade

Schema é uma ontologia que, como padrão web, pode contribuir para a integridade dos dados. O risco para a integridade dos dados é a ambiguidade. A ambigüidade leva a alucinações. Alucinações como uma bola de neve. Eventualmente, o resultado se agrava, o que pode levar a resultados imprecisos ou até mesmo a um pré-treinamento incorreto de LLM, que pode ter efeitos mais duradouros.

Se um agente puder interpretar você mal, em algum momento isso acontecerá. Os LLMs podem então correr o risco de viajar para uma “deriva semântica” desviada dos factos e a favor da narrativa. Isso foi explorado em um artigo intitulado “Sangue e Grafi: ensinando um pequeno modelo a ler a linhagem”, de Andrea Volpini e Chiara Carrozza, onde os modelos de fronteira tendiam a cair na narrativa em detrimento dos fatos, enquanto um pequeno modelo com ferramentas de gráfico de conhecimento se igualava a eles.

Sangue e gráficos, por WordLift
Imagem do autor, julho de 2026

→ Leitura adicional: Recuperação de Informação Parte 1: Desambiguação

5 camadas de integridade de dados

Tudo isso corrobora minha crença de que o papel do SEO é maximizar a integridade dos dados, cujo esquema desempenha um papel. Abaixo, ilustro cinco camadas do que a integridade de dados pode incluir:

5 camadas de integridade de dados
Imagem do autor, julho de 2026
  1. Entidades: O que existe e o que é essa coisa. Coisa, Organização e Pessoa, estabilizados com @ids e vinculados ao Wikidata, GS1, ISNI ou ORCID para que um agente reconheça sua “Apple” da fruta.
  2. Relacionamentos: Como essas coisas se conectam. @id e SameAs, RDF. Recurso de agregação de esquema do Yoast SEO e EntityMap de Dixon Jones.
  3. Formatar: Como a estrutura é serializada e servida. JSON-LD, RDFa e microdados. Markdown também (abrangendo LLMs.txt, agents.md, OKF) e endpoints (negociação de conteúdo, ARD, MCP).
  4. Ações: O que pode ser feito, declarado aos agentes. Ações do Schema.org, como BuyAction, além dos mais recentes WebMCP, ACP e UCP.
  5. Percepção: Aterramento, percepção de terceiros, sentimento, etc.

Agregação, orientação e consumo

Em uma postagem que escrevi em outubro do ano passado, eu disse: “Os SEOs terão que considerar os dois lados da web e como servir a ambos”. Os protocolos emergentes (todos lançados nos últimos dois anos) mostram que isso é verdade, onde uma nova “pilha de aterramento agente” geralmente adota um dos três objetivos:

Protocolo Meta O que isso faz
mapa do site.xml Agregação Cada URL canônico em um único índice XML.
llms.txt Agregação Resumo do conteúdo de um site com informações importantes e links para leituras adicionais.
Agregação de esquema Yoast Agregação JSON-LD de nível de página em um gráfico conectado para todo o site.
Mapa de entidades Agregação As declarações de entidade de um site em um mapa explícito.
Catálogo de Conhecimento Agregação Dados estruturados, não estruturados e SaaS em um mecanismo de contexto governado.
OKF Agregação Conhecimento do site em um pacote de descontos em /okf/.
ARD ai-catalog.json Agregação As ferramentas e agentes de um domínio em um catálogo; registros federados acima dele.
Abrir KB Agregação Documentos fonte compilados em um wiki markdown.
Schema.org Orientação O vocabulário compartilhado que diz às máquinas o que as coisas significam.
agentes.md Orientação Como os agentes devem representar e interagir com você.
Remarcação para agentes Consumo O mesmo URL serviu como remarcação limpa por meio de negociação de conteúdo.
Saída alternativa de redução Consumo Uma versão .md separada vinculada a rel=alternate.
/ponto de extremidade de rastreamento Consumo Renderiza uma página ou site inteiro como uma redução limpa sob demanda.
WebMCP Consumo Expõe as ações de um site como ferramentas que um agente pode invocar.
NLWeb Consumo Ingere esquemas, feeds e mapas de sites para responder a consultas em linguagem natural.
ACP Consumo Check-out do agente dentro do ChatGPT em relação aos dados do produto do comerciante.
PCU Consumo Uma linguagem comum para ações de comércio de agentes em todas as superfícies.

Esses três objetivos ajudam a reduzir o número de solicitações e ao mesmo tempo aumentam a eficiência do token. Alguns dos protocolos acima foram abordados com mais detalhes no Search Engine Journal, incluindo o meu sobre ACP e UCP e o artigo completo de Emina Demiri-Watson sobre OKF, ARD e outros no início deste mês.

Mas há algo que nenhum desses protocolos tem…

Não há consenso ou padrão acordado

Schema.org nasceu do consenso entre Google, Microsoft/Bing e Yahoo! (Yandex juntou-se mais tarde) que o lançou sob governança conjunta. O mesmo aconteceu cinco anos antes com o mapa do site XML. Quando os motores de busca precisaram de um padrão, eles simplesmente sentaram e criaram um – juntos.

Nada parecido com isso está acontecendo agora, e isso prejudica os SEOs que realmente desejam clareza sobre o que implementar e o que não implementar nos sites em que trabalham. Até mesmo factos básicos sobre o consumo são contestados, sendo o debate sobre as remarcações um grande exemplo disso.

Enquanto estes debates continuam, não há espaço onde as plataformas se reúnam e concordem com um padrão universal. O ecossistema mudou tão dramaticamente que estas empresas não estão no negócio da Pesquisa e do bem da web, mas devem agora navegar como os seus negócios afectam os empregos, as economias, os meios de subsistência e o futuro da humanidade como um todo. Como tal, simplesmente não acredito que as questões colocadas pelos SEOs estejam no topo das suas prioridades.

O que você pode fazer sobre isso agora?

Olhando para trás, para as cinco camadas de integridade de dados, as quatro sobre as quais você tem controle podem ser ilustradas abaixo ao observar como pode ser uma pilha de aterramento de agente:

Opções de pilha de aterramento agente
Imagem do autor, julho de 2026

Há muito a considerar e todos têm objetivos e dívidas técnicas diferentes. Decida quais são mais aplicáveis ​​a você, bem como adote qualquer coisa que não exija muito débito técnico.

Se eu tivesse que escolher um pedido, seria esse.

  • Estabilize seus @ids e adicione links SameAs ao Wikidata e a outras autoridades primeiro, porque todo o resto depende disso.
  • Em seguida, teste como você realmente é interpretado, com NLWeb, em vez de presumir que o gráfico é lido da maneira desejada.
  • Se você trabalha no comércio eletrônico, audite o feed de produtos antes de tocar em qualquer coisa brilhante e observe BuyAction enquanto estiver lá: apenas ReadAction e SearchAction são implantados em qualquer escala real hoje, portanto, o campo está genuinamente aberto. Veja as notícias recentes sobre o que foi adicionado ao esquema do Produto.
  • Tente implementar o WebMCP. Isso pode ser feito em qualquer site e não precisa ser um comércio eletrônico.
  • O serviço de Markdown e a negociação de conteúdo podem esperar até que você tenha capacidade de engenharia de sobra (a menos que você possa usar o Markdown para Agentes da Cloudflare).
  • Dê uma olhada em OKF e ARD. Quando o Google lança novos protocolos, sempre presto atenção – especialmente quando se trata de como um agente ou LLM entende um site como um todo.

Nada disso é uma aposta em um protocolo específico. A implementação de qualquer um deles reduz o risco de um LLM ter que percorrer “o caminho mais longo” para formar a resposta com a qual deseja responder. Ao cobrir as apostas para receber qualquer agente de qualquer plataforma, isso também ajudará você a pensar mais sobre exatamente como seu site pode ser interpretado por eles e como isso melhora quando esses protocolos são adotados.

Mesmo que você queira fazer pequenos experimentos longe de sites maiores, vale a pena explorar não apenas para ver se há resultados positivos, mas também para entender como todos eles funcionam na prática. Isso é exatamente o que fiz recentemente, onde reconstruí meu site pessoal, que tem vários protocolos “prontos para agentes” em execução, incluindo negociação de conteúdo, markdown alternativo, llms.txt e WebMCP.

Não persiga o protocolo, controle as camadas subjacentes

Neste momento, parece que não existe um único “vencedor” que irá progredir de uma proposta ou protocolo para um padrão web. Não há consórcio para repetir o que foi feito com o sitemap XML e o Schema.

A pilha agora é grande, mas há uma coisa que todos compartilham. Quer agregue, oriente ou consuma, cada um é alimentado pelo mesmo substrato: entidades precisas, relações explícitas e conteúdo que uma máquina pode ler sem adivinhar ou pesquisar mais.

As classificações eram as métricas de sucesso da antiga web. Confiança, integridade, precisão e validade. Ganhar isso ainda é o papel de um SEO.

Mais recursos:


Imagem em destaque: hmorena/Shutterstock



Source link

Postagens Similares

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *