Após 6 meses de anúncios ChatGPT, os anunciantes ainda não sabem o que é ‘bom’

Os anúncios ChatGPT mudaram bastante desde que a OpenAI começou a testar anúncios em fevereiro.
A plataforma agora oferece aos anunciantes mais maneiras de comprar, otimizar e avaliar campanhas, com acesso de autoatendimento disponível em 52 países até o momento.
Também temos algo que não tínhamos no lançamento: resultados reais de anunciantes que gastaram dinheiro na plataforma.
Alguns estão relatando custos por clique (CPCs) abaixo de US$ 3. Outros estão mais próximos de US$ 10 ou até US$ 13. Existem exemplos de campanhas que geraram leads qualificados a custos competitivos, juntamente com outras que produziram pouca atividade significativa após o clique.
O problema é saber o que fazer com essas diferenças.
A OpenAI afirma que ainda não possui benchmarks de desempenho entre anunciantes, setores ou tipos de campanha. Também há relatórios limitados sobre concorrência ou em nível de leilão para ajudar a explicar por que um anunciante pode pagar substancialmente mais do que outro.
Seis meses depois, os anunciantes têm mais dados de anúncios ChatGPT para trabalhar. Mas ainda têm muito pouco contexto para decidir como deve ser o “bom” desempenho.
O que os anunciantes podem realmente medir nos anúncios ChatGPT
O ChatGPT Ads Manager oferece aos anunciantes a maioria das métricas básicas de desempenho necessárias para avaliar suas próprias campanhas.
Os relatórios estão disponíveis nos níveis de campanha, grupo de anúncios e anúncio, incluindo:
- Impressões.
- Cliques.
- Gastar.
- Taxa de cliques.
- CPC médio.
- Custo médio por mil (CPM).
- Conversões.
Os anunciantes também podem exportar dados de desempenho para CSV para análise fora da plataforma.
O rastreamento de conversões está disponível por meio do OpenAI Pixel e da API de conversões, com suporte para ações que incluem compras, leads e inscrições. OpenAI também pode incluir conversões modeladas, quando disponíveis.
Para anunciantes de comércio eletrônico, os relatórios podem incluir vendas atribuídas, custo por venda atribuída e ROAS quando essas métricas estiverem disponíveis.
Isso é tudo que diz o relatório atual.
Não há equivalente ao Auction Insights, parcela de impressões ou relatórios competitivos. A OpenAI também não publicou benchmarks de desempenho entre anunciantes, setores ou tipos de campanha.
Essas lacunas tornam difícil contextualizar até mesmo uma métrica simples como o CPC, especialmente quando o leilão em si dá aos anunciantes relativamente pouca visibilidade sobre o que influenciou o preço que pagaram.
Veja também: Como medir o desempenho do PPC quando a IA controla o leilão
O que os anunciantes não conseguem ver por trás do leilão
A falta de relatórios competitivos é mais importante quando você considera como o ChatGPT Ads decide quais anúncios exibir.
OpenAI usa um leilão de segundo preço ponderado por relevância. A seleção de anúncios é baseada principalmente no contexto e na intenção da conversa, juntamente com sinais da página de destino, criativo do anúncio e dicas de contexto fornecidas pelo anunciante.
Essas dicas de contexto dão aos anunciantes uma maneira de descrever produtos, necessidades ou situações relevantes no nível do grupo de anúncios, mas não são palavras-chave. A OpenAI também deixa claro que não garante a entrega de palavras, públicos ou conversas específicas.
Isso dá aos anunciantes menos visibilidade sobre as decisões de correspondência individuais que ocorrem antes de um anúncio entrar ou vencer um leilão.
Se o CPC aumentar, por exemplo, os relatórios disponíveis fornecem pouca ajuda para separar as mudanças na concorrência da relevância, do inventário, dos lances ou dos tipos de conversas que estão sendo correspondidas.
O leilão de segundo preço acrescenta outra camada de complexidade. Os anunciantes conhecem seu lance máximo e quanto pagaram, mas não conseguem ver a pressão competitiva por trás desse preço ou como a relevância afetou o resultado.
Isso dificulta a interpretação dos CPCs individuais fora do contexto da campanha do próprio anunciante.
E os resultados publicados pelos anunciantes até agora mostram quão grandes podem ser essas diferenças.
O que os primeiros resultados dos anunciantes mostram até agora
Temos mais dados de anúncios ChatGPT em primeira mão do que há alguns meses. Alguns anunciantes também gastaram o suficiente para ultrapassarmos as campanhas de teste de US$ 500 que eram comuns no início.
Os resultados ainda variam um pouco, como pode ser visto abaixo de alguns anunciantes que compartilharam seus dados.
Hostinger gastou quase US$ 70.000 testando anúncios ChatGPT
A Hostinger tem um dos maiores testes compartilhados publicamente que encontrei até agora.
Hüseyin Ograk, chefe de PPC da Hostinger, relatou inicialmente que os CPCs não eram superiores aos da Pesquisa Google e que as campanhas já haviam gerado compras. Ele também descreveu o forte envolvimento do tráfego.
Sua avaliação tornou-se mais sutil à medida que os gastos aumentavam.
Depois de quase US$ 70.000 em testes, Ograk relatou CPMs acima de US$ 65, mas disse que o CTR era uma preocupação maior. Casos de uso mais específicos tiveram melhor desempenho, enquanto mensagens mais amplas tiveram dificuldades consistentes.
Ele também observou qualidade de tráfego inconsistente e desafios na avaliação do retorno do investimento publicitário com base apenas em conversões diretas.
Testes semelhantes estão produzindo resultados muito diferentes
Outros testes publicados mostram como é difícil tirar conclusões apenas com base no CPC.
Common Thread Collective compartilhou resultados de um anunciante de comércio eletrônico de alto valor médio de pedido (AOV) que passou de US$ 7 por dia para mais de US$ 1.000 por dia durante aproximadamente um mês. Após gastos de US$ 9.620, a campanha teve uma média de CPC de US$ 4,41 e CTR de 0,94% em 136.000 impressões semanais.
A CTC relatou entre US$ 19.000 e US$ 38.000 em receita atribuída, dependendo do modelo de atribuição, com ROAS estimado variando de 3,3x a 6,8x. A equipe contou com o Triple Whale junto com os relatórios do ChatGPT Ads para avaliar o desempenho downstream.
Floyd Blaikie descobriu algo diferente quando sua equipe olhou além das métricas disponíveis no Ads Manager.
Sua campanha B2B gastou cerca de US$ 7.000 CAD e teve uma média de CPC de US$ 9,29, CPM de US$ 64,34 e CTR de 0,7%. Sua equipe então usou a desanonimização de visitantes para identificar 146 organizações por trás de 336 cliques pagos.
A parte maluca? Apenas cinco correspondiam ao perfil de cliente ideal.
A análise externa de Blaikie levanta uma preocupação maior do que o próprio CPC de US$ 9,29. Muito poucos visitantes identificáveis correspondiam ao ICP do anunciante, e o Ads Manager não ofereceu nenhuma maneira de descobrir isso por conta própria.
O teste de Synter mostra outra fonte de variação: geografia.
Com gastos de US$ 4.428,84, a Synter obteve uma média de CPC geral de US$ 9,89. Mas esse número mudou consideravelmente por mercado, de US$ 5,10 no Reino Unido para US$ 10,62 nos EUA. O CPC atingiu US$ 17,59 na Austrália e US$ 22,89 na Nova Zelândia, embora ambos os mercados tivessem um volume consideravelmente menor.
Nesses testes, os CPCs variam amplamente de acordo com o anunciante e o mercado. Os relatórios disponíveis ainda não fornecem informações suficientes para explicar essas diferenças ou estabelecer uma expectativa confiável sobre quanto os anunciantes deveriam pagar.
A recomendação de CPC máximo inicial de US$ 3 a US$ 5 da OpenAI também não resolve necessariamente esse problema.
A recomendação de US$ 3 a US$ 5 não é uma referência de CPC
Um número já começou a aparecer com frequência em discussões sobre anúncios ChatGPT: US$ 3 a US$ 5 por clique.
A figura vem diretamente da OpenAI, mas o que ela representa é importante. A OpenAI recomenda um lance máximo inicial de CPC entre US$ 3 e US$ 5. O Ads Manager também pode fornecer orientações sobre a intensidade do lance, indicando se um lance é competitivo ou pode limitar a entrega.
Essa recomendação não representa um CPC médio em toda a plataforma. A OpenAI afirma explicitamente que os anúncios ChatGPT ainda não possuem benchmarks de desempenho entre anunciantes, setores ou tipos de campanha.
Os primeiros resultados dos anunciantes que já analisamos reforçam o quão pouco a recomendação de US$ 3 a US$ 5 nos diz sobre quanto um anunciante acabará pagando.
O risco é que referências repetidas à recomendação acabem eliminando a palavra “recomendado”. Um lance inicial de US$ 3 a US$ 5 torna-se um “referência” de US$ 3 a US$ 5, embora a OpenAI não tenha publicado tal referência.
O risco é que referências repetidas à recomendação acabem eliminando a palavra “recomendado”. Um lance inicial de US$ 3 a US$ 5 torna-se um “referência” de US$ 3 a US$ 5, embora a OpenAI não tenha publicado tal referência.
Esse enquadramento já está se estreitando. Em agosto, a OpenAI tornou Maximizar resultados a estratégia de lances padrão para novos grupos de anúncios qualificados, que define e ajusta os lances automaticamente. A documentação da OpenAI afirma que não garante a entrega em relação a uma meta específica de CPA, CPC ou ROAS. Os anunciantes que desejam um teto rígido terão que optar novamente pelo lance manual.
Portanto, o número é um lance inicial, para os anunciantes que ainda estão definindo um.
O público qualificado para ver os anúncios ChatGPT não é o mesmo da base total de usuários do ChatGPT, embora a lacuna seja mais sobre a composição do que o tamanho. Os anúncios alcançam usuários Free and Go, que constituem a maior parte do público do ChatGPT, mas todos os níveis de preço mais alto são excluídos.
Veja também: O paradoxo do alto CPC: quando cliques caros são um sinal de sucesso
Os anúncios ChatGPT alcançam apenas parte do público ChatGPT
Os anunciantes também precisam ter cuidado ao usar o tamanho geral do público do ChatGPT para avaliar a oportunidade de publicidade.
Os anúncios só podem ser exibidos para usuários de planos Free and Go. Além disso, as contas Pro, Business, Enterprise e Edu permanecem livres de anúncios, e a OpenAI não exibe anúncios para contas identificadas como pertencentes a menores de 18 anos.
Isso significa que o número total de pessoas que usam o ChatGPT não é igual ao público atualmente qualificado para ver anúncios.
O próprio Go é uma assinatura paga, então seria impreciso caracterizar o público apoiado por anúncios como pessoas que não pagam pelo ChatGPT. Ainda assim, vários níveis de assinatura mais caros da OpenAI são excluídos do público publicitário.
Isso levanta uma consideração interessante para marcas de luxo, produtos caros e outros anunciantes com um perfil de cliente mais restrito.
Não há dados públicos suficientes sobre a demografia ou o poder de compra do público-alvo qualificado para anúncios do ChatGPT para saber até que ponto ele se alinha com esses clientes. Estatísticas mais amplas sobre usuários do ChatGPT também não são necessariamente representativas, pois incluem pessoas em planos onde os anúncios não aparecem.
Isso não significa que os anunciantes de alto valor devam ficar longe. Common Thread Collective, por exemplo, já relatou resultados positivos de uma campanha de comércio eletrônico de alto AOV.
Mas isso pode dar a esses anunciantes outro motivo para serem cautelosos ao aplicar suposições mais amplas de audiência do ChatGPT aos seus planos de mídia.
A geografia restringe ainda mais a comparação. O piloto ChatGPT foi lançado nos EUA em fevereiro, juntamente com Canadá, Austrália e Nova Zelândia. A OpenAI anunciou a expansão para o Reino Unido, Japão, Coreia do Sul, Brasil e México em maio, com Brasil e México entrando em operação em agosto. O acesso do Self-service Ads Manager alcançou 52 países em 31 de agosto, e a OpenAI afirma que os anúncios podem ser adquiridos em mais de 40 mercados por meio de sua equipe de vendas e parceiros.
Entre a elegibilidade do plano, a geografia e os dados de público limitados, os anunciantes ainda trabalham com uma imagem bastante incompleta de quem podem alcançar.
Isso torna o design do teste e os critérios de sucesso do próprio anunciante ainda mais importantes.
Como abordar os anúncios ChatGPT agora mesmo
A falta de benchmarks estabelecidos não deve impedir os anunciantes de testar anúncios ChatGPT, especialmente aqueles que buscam expandir além do mix de canais existente.
Basta fazer o teste sabendo que ainda há limites para o que a plataforma pode lhe dizer.
Defina expectativas antes do início dos gastos com base no que faria valer a pena continuar o canal para o seu negócio. O CPC ou CTR de outra pessoa oferece pouca orientação quando ainda sabemos tão pouco sobre a concorrência, o público e as conversas por trás desses resultados.
A medição fora do Ads Manager também deve fazer parte do plano desde o início. Alguns dos primeiros testes com anunciantes encontraram insights mais úteis em outros lugares, incluindo atribuição de receita, dados de engajamento e identificação de quais empresas realmente visitaram o site.
Os primeiros resultados também merecem mais escrutínio do que em uma plataforma madura. Com menos sinais de diagnóstico disponíveis, pode ser difícil separar um verdadeiro problema de desempenho das diferenças na entrega, na correspondência ou nas conversas disponíveis durante o período de teste.
Os anunciantes podem precisar de mais evidências antes de decidir por que o desempenho mudou em uma direção ou outra.
Os anúncios ChatGPT continuarão mudando e os dados disponíveis aos anunciantes deverão melhorar com isso. A OpenAI já disse que métricas adicionais, visualizações de relatórios e insights estão planejados à medida que o Ads Manager se desenvolve.
Por enquanto, não existe um número universal que determine se uma campanha ChatGPT Ads está tendo um bom desempenho.
“Bom” tem que começar pelo que o canal produz para o seu negócio.
Mais recursos:
Imagem em destaque: Roman Samborskyi/Shutterstock






