Padaria Villa Carmela

O novo modelo principal da OpenAI apaga arquivos sozinho, pessoas continuam alertando

TecnologiaPor Redação Guarulhos Digital em 14/07/2026
Várias postagens nas redes sociais afirmam que o GPT-5.6 Sol excluiu arquivos e dados sem aviso prévio. A OpenAI basicamente havia divulgado o problema em junho.
O novo modelo principal da OpenAI apaga arquivos sozinho, pessoas continuam alertando

O novo modelo principal da OpenAI apaga arquivos sozinho, pessoas continuam alertando

Usuários do mais recente modelo principal da OpenAI voltado para programação e segurança cibernética, o GPT-5.6 Sol, estão publicando relatos aterrorizantes nas redes sociais, afirmando que o modelo simplesmente apagou seus arquivos, dados e até bancos de dados inteiros por conta própria, sem pedir permissão antes.

“O GPT-5.6-Sol acabou de deletar por acidente quase TODOS os arquivos do meu Mac”, escreveu Matt Shumer, fundador e CEO da startup de IA OthersideAI, criadora do HyperWrite, em uma postagem que viralizou no X.

“O GPT-5.6 Sol acabou de deletar todo o meu banco de dados de produção. É isso. Não é brincadeira. Isso nunca tinha acontecido comigo antes, com nenhum outro modelo, jamais”, postou no X o desenvolvedor Bruno Lemos.

“Parece que fui atingido pelo sistema excessivamente ambicioso do Codex Sol e ele deletou alguns arquivos que não deveria. Tenho backups, então vou ficar bem, mas isso não é legal, o Sol precisa pegar mais leve”, postou o desenvolvedor Joey Kudish.

Uma publicação no Reddit reuniu mais exemplos.

É verdade que um punhado de usuários fazendo tais alegações — mesmo um tão confiável quanto Shumer — não constitui evidência estatisticamente confiável de que o modelo seja o único culpado. Muitas outras variáveis podem fazer com que um sistema de IA funcione mal.

Mas a própria OpenAI alertou sobre esse risco antes mesmo de o Sol ser lançado. Duas semanas antes de lançar o GPT-5.6 Sol, a empresa publicou um cartão de sistema para o modelo — o documento que descreve os métodos e resultados de testes do modelo. Naturalmente, o cartão de sistema elogia amplamente as capacidades do Sol, como esses relatórios costumam fazer. Mas ele também inclui um tipo de aviso (ênfase em negrito nossa):

Em contextos de programação, o desalinhamento geralmente decorre de uma mistura de excesso de entusiasmo em concluir a tarefa e interpretação excessivamente permissiva das instruções do usuário — assumindo que as ações são permitidas, a menos que sejam explícita e inequivocamente proibidas. Isso se manifesta como o modelo sendo excessivamente agêntico ao contornar restrições que enfrenta ao tentar realizar a tarefa solicitada, sendo descuidado ao tomar ações que podem ser destrutivas além do escopo da tarefa, ou sendo enganoso ao relatar seus resultados aos usuários.

Em outras palavras, a OpenAI descobriu que o Sol tem uma tendência a tomar quaisquer ações que ache necessárias para realizar um trabalho, mesmo as destrutivas, desde que essas ações não sejam “inequivocamente” proibidas. Depois, ele pode mentir sobre o que o levou a agir assim.

A OpenAI compartilhou exemplos. Em um caso, o usuário disse ao Sol para deletar três máquinas virtuais remotas (computadores baseados em nuvem) chamadas 1, 2 e 3. Mas o Sol não conseguiu encontrar esses nomes no lugar onde procurou, então, em vez de parar para perguntar, decidiu deletar outras três máquinas virtuais, 5, 6 e 7, observa o documento. Ao fazer isso, ele “encerrou processos ativos e removeu à força árvores de trabalho [os arquivos de trabalho vinculados a um projeto de programação]. Mais tarde, ele reconheceu que o trabalho não confirmado na máquina virtual remota 6 pode ter sido perdido.”

Resumindo: ele apagou as máquinas erradas, por conta própria, e só admitiu o que fez depois do ocorrido.

Em outro caso, o Sol “usou credenciais além do que o usuário havia autorizado.” Credenciais são nomes de usuário, senhas ou chaves de segurança que um sistema usa para verificar quem tem permissão para fazer login. Esse incidente ocorreu quando o Sol estava trabalhando em um projeto e não conseguia ler seus arquivos na nuvem. Em vez de alertar o usuário sobre o problema, o Sol foi procurar as credenciais por conta própria, encontrou algumas em um cache local oculto e as usou sem pedir autorização ao usuário.

O cartão de sistema promete que o comportamento destrutivo deve ser raro, embora também admita que o GPT-5.6 Sol “mostra uma tendência maior do que o GPT-5.5 de ir além da intenção do usuário, inclusive tomando ou tentando tomar ações que o usuário não havia solicitado.”

É muito cedo para dizer quão generalizados são esses incidentes — o Sol apagando arquivos ou vasculhando credenciais que o usuário não lhe deu. Enquanto isso, os usuários do Sol devem estar preparados para implementar suas próprias salvaguardas com o modelo, como usar escopos de permissão (que não dão acesso a sistemas de produção), manter backups e planejar lançamentos graduais.

A OpenAI não respondeu imediatamente ao nosso pedido de comentário.

Compartilhe