OpenAI trabalhando em uma ‘estrutura’ para compartilhar incidentes com agentes desonestos

Após o hack do Hugging Face e o mais recente “incidente wiki”, a OpenAI afirmou no sábado que está trabalhando em uma “estrutura” para como e quando compartilhar informações sobre incidentes envolvendo agentes desonestos.
Em 4 de setembro, a Reuters informou que agentes da OpenAI assumiram o controle de um site wiki em alemão e o usaram para se comunicarem entre si. Quatro membros anônimos da empresa disseram ao meio de comunicação que a OpenAI e sua equipe jurídica resistiram aos esforços internos para investigar o incidente.
OpenAI e Microsoft enfrentam processo de direitos autorais de jornais locais
Em uma postagem de 5 de setembro no X, o proprietário do ChatGPT reconheceu a violação: “Como pensamos sobre o ‘incidente wiki’, onde nossos agentes escreveram para vários sites da Internet: já passou da hora de definirmos padrões para quando e como compartilhamos incidentes de desalinhamento, não apenas propriedades de desalinhamento de nossos modelos”.
Este Tweet não está disponível no momento. Pode estar carregando ou foi removido.
A declaração continua, dizendo que a empresa historicamente tratou o “desalinhamento” como uma questão de pesquisa, mas em 2026, a OpenAI “começou a ver o desalinhamento causar novos tipos de impacto no mundo real”.
A OpenAI seguiu um manual tradicional de resposta a incidentes de segurança para Hugging Face, diz o comunicado, e sua investigação continua.
Velocidade da luz mashável
A empresa viu os primeiros sinais de agentes usando a Internet de maneira não intencional, afirmou a empresa, apontando para três postagens de blog publicadas antes do incidente do Hugging Face: uma postagem de março de 2026 sobre como monitora desalinhamento dos agentes; o cartão de sistema de julho de 2026 para GPT-5.6 sobre seus riscos de segurança; e uma postagem de julho de 2026 sobre segurança em modelos de longo horizonte, onde a OpenAI admitiu que os agentes podem realizar “ações indesejadas”. A empresa disse que considera o incidente da wiki um “caso de desalinhamento” semelhante.
A OpenAI afirmou que suas práticas de divulgação de desalinhamento precisam ser expandidas e, até o momento, ela e a maior empresa de IA não possuem um padrão claro para relatar isso. “Estamos trabalhando em uma estrutura e a compartilharemos nas próximas semanas e, paralelamente, estamos trabalhando com dezenas de agências reguladoras governamentais em todo o mundo nessas questões”.
A declaração não revela como a empresa está trabalhando para impedir esses desalinhamentos, nem se consegue.
Na segunda-feira, a OpenAI enviou à Comissão Europeia um relatório sobre o incidente da wiki, disse um porta-voz da Comissão à Reuters.
ATUALIZAÇÃO: 7 de setembro de 2026, 12h35 EDT Este artigo foi atualizado com a notícia de que a OpenAI enviou um relatório à Comissão Europeia.
Divulgação: Ziff Davis, empresa controladora da Mashable, em abril de 2025 entrou com uma ação contra a OpenAI, alegando que ela infringiu os direitos autorais de Ziff Davis no treinamento e operação de seus sistemas de IA.





