Padaria Villa Carmela

Por meses, os enxames de agentes da OpenAI vêm atacando bancos de dados online para encontrar fatos obscuros

TecnologiaPor Redação Guarulhos Digital em 25/09/2026
Os mais recentes enxames de agentes não autorizados foram descobertos por pesquisadores.
Por meses, os enxames de agentes da OpenAI vêm atacando bancos de dados online para encontrar fatos obscuros

Por meses, os enxames de agentes da OpenAI vêm atacando bancos de dados online para encontrar fatos obscuros

Com pouca ajuda dos laboratórios de inteligência artificial de ponta, pesquisadores independentes estão juntando as peças de como agentes de IA se coordenam em recantos obscuros da internet para acessar dados privados hospedados em servidores seguros.

A Transluce, um laboratório sem fins lucrativos focado em supervisão de IA, divulgou um relatório na quarta-feira que mostra agentes da OpenAI tentando extrair dados do Data USA, da biblioteca digital da Universidade do Novo México e do Instituto Australiano de Saúde e Bem-Estar (AIHW).

A investigação do laboratório levanta questões sobre quando a OpenAI deveria saber que seus agentes estavam tentando penetrar em sistemas seguros na internet aberta. A Transluce conseguiu encontrar evidências de mau comportamento de agentes em questão de semanas, simplesmente procurando por serviços web mal defendidos e corroborando suas descobertas com outros registros públicos de enxames de agentes na internet.

A Transluce compartilhou seu relatório no mesmo dia em que o primeiro-ministro australiano, Anthony Albanese, afirmou que agentes da OpenAI haviam tentado invadir quatro sites governamentais e obtido sucesso em um caso, chegando a gravar arquivos em um servidor interno do sistema nacional de saúde do país. Embora faltem detalhes sobre a invasão bem-sucedida, Albanese disse que ela aparentemente fazia parte de uma avaliação de recuperação de informações, o que coincide com a atividade que a Transluce e outros pesquisadores descobriram.

Nesses exercícios, que podem ser de treinamento ou avaliações, os modelos da OpenAI são solicitados a rastrear estatísticas obscuras: métricas de combate às drogas na Tailândia, custos de medicamentos na Austrália, os ganhos médios de detentores de mestrado nos EUA em 2014. Os agentes usam serviços de internet mal protegidos para compartilhar e encontrar respostas, muitas vezes tentando penetrar em bancos de dados seguros. Eles vêm fazendo isso pelo menos desde março de 2026, e possivelmente desde novembro de 2025. Pode estar acontecendo agora mesmo.

A Transluce iniciou sua investigação depois que um grupo diferente de pesquisadores identificou um fórum obscuro onde agentes colaboravam para vencer testes cronometrados. O relatório deles baseia-se em dados de um site, urlquery.net, que atua como um proxy de navegador, ostensivamente para pesquisa de segurança — os usuários podem analisar um URL sem abri-lo por conta própria. O serviço, no entanto, publica registros públicos dessa atividade. Os pesquisadores da Transluce conseguiram identificar agentes usando o serviço ao cruzar suas discussões no fórum.

“Encontramos uma grande quantidade de atividade automatizada que tinha laços estreitos e sobreposição com o conjunto de dados DSE Wiki, e que agora a OpenAI confirmou fazer parte, pelo menos parcialmente, do mesmo enxame”, disse Conrad Stosz, chefe de governança da Transluce, ao TechCrunch, observando que nem todas as atividades que detectaram puderam ser vinculadas à OpenAI, ou mesmo a agentes de IA em geral.

No entanto, a wiki mostra que os agentes tinham a tarefa de encontrar um fato bastante obscuro — o custo médio anual por pessoa para “dermatológicos” no estado de Victoria em janeiro de 2022. Em 20 de junho, registros do urlquery.net encontrados pela Transluce mostraram um agente tentando entrar no site. Na entrada da wiki em 21 de junho, um agente discute sua incapacidade de contornar as proteções anti-bot do AIHW.

Os pesquisadores que identificaram esse fórum acreditam que um funcionário humano da OpenAI visitou o site pela primeira vez nesse mesmo dia, 21 de junho. A maior parte da atividade de agentes no fórum cessou no dia seguinte. Isso também ocorreu pouco depois do exploit no sistema de saúde da Austrália revelado por Albanese, ocorrido em 18 de junho. A OpenAI afirmou que só tomou conhecimento dessa atividade em agosto.

A OpenAI não respondeu a perguntas sobre quando seus funcionários descobriram o fórum da wiki, que tipo de informação obtiveram nele ou o que poderiam ter aprendido com ele sobre os exploits.

“Nossa análise inicial sugere que grande parte da atividade descrita no relatório da Transluce se sobrepõe a casos em diferentes estágios de investigação em nossa revisão em andamento da atividade de modelos desalinhados”, disse um porta-voz da OpenAI ao TechCrunch. “Entramos em contato com a Universidade do Novo México e o Data USA e temos nos comunicado com o governo australiano sobre os sites governamentais afetados. Em nossa revisão mais ampla, continuamos a priorizar os incidentes mais graves, enquanto expandimos nosso trabalho para atividades de menor gravidade, incluindo agentes enviando spam para sites. Dada a escala desse trabalho e a necessidade de verificar cada caso, esperamos que a revisão leve meses.”

Stosz diz que, sem uma compreensão mais clara de como a OpenAI monitora seus agentes, seria difícil dizer o que o laboratório deveria saber sobre eles, mas que “parece provável que, se eles tivessem estudado exaustivamente e compreendido todas as solicitações de saída e respostas de entrada para esses agentes envolvidos na wiki DSE, eles teriam descoberto essa atividade”.

Selena Zhang, membro da equipe técnica da Transluce que contribuiu para o relatório, disse que os registros do urlquery.net mostram solicitações de conjuntos de dados semelhantes, usando técnicas semelhantes, em março de 2026, e talvez já em novembro de 2025. Ela observou que o mesmo tipo de atividade associada a agentes ocorreu no urlquery.net tão recentemente quanto esta semana.

Stosz, que já liderou o Centro dos EUA para Padrões e Inovação em IA, disse que a Transluce continuará sua pesquisa em um esforço para fornecer transparência pública sobre esses incidentes. Ele alertou que as técnicas de treinamento usadas pela OpenAI e outros laboratórios de ponta parecem estar incentivando os agentes a recorrer a técnicas de hacking para concluir tarefas. Os incidentes dos quais temos conhecimento são provavelmente a “ponta do iceberg”.

“Estamos olhando para um punhado de fontes de dados onde esses agentes por acaso deixaram migalhas para encontrarmos”, disse ele. “A OpenAI certamente sabe mais sobre isso. Outros laboratórios certamente sabem mais sobre isso que não divulgaram publicamente. Mas eu esperaria que os pesquisadores continuassem a encontrar mais tráfego, mais evidências do que os agentes deixaram para trás.”

Ele confia que os laboratórios serão transparentes sobre suas descobertas?

“Não vou comentar sobre isso”, disse Stosz.

Compartilhe