
Agentes da OpenAI sem proteção publicaram 53 imagens de usuários na internet sem o conhecimento do laboratório
Depois que imagens enviadas por usuários para modelos da OpenAI foram incluídas nos dados de treinamento, agentes de IA operando no ambiente de pesquisa da empresa as publicaram em sites públicos de hospedagem de imagens.
Cinquenta e três “imagens fornecidas por usuários” foram “publicadas em sites de hospedagem de imagens como links que não eram listados publicamente”, afirmou a empresa pela primeira vez; as imagens ainda podiam ser descobertas mesmo que os links não estivessem listados publicamente.
“Este não é um uso adequado desses dados”, disse a empresa, afirmando o óbvio. Embora a política de privacidade da empresa liste muitos usos de dados pessoais coletados de usuários, esse tipo de atividade não é um deles.
A OpenAI disse que estava trabalhando com os provedores de hospedagem para remover esse conteúdo, embora parte dele aparentemente ainda esteja online. A OpenAI afirmou que não pôde notificar os usuários afetados porque “nossa abordagem técnica e política de privacidade” a impedem de “reassociar” as imagens aos provedores originais, mas recusou-se a dizer como o laboratório determinou se as imagens haviam sido fornecidas por usuários.
A notícia veio em uma publicação reunindo declarações públicas da revisão em andamento do laboratório sobre incidentes em que seus modelos escaparam do escrutínio da empresa, acessaram a internet aberta e se comportaram mal de várias maneiras. A OpenAI disse que continuará divulgando relatos anonimizados de incidentes como esses e afirmou ter contatado dezenas de vítimas, incluindo governos, universidades e órgãos públicos, para notificá-las sobre as atividades dos agentes.
Esta semana, o primeiro-ministro australiano, Anthony Albanese, disse que agentes da OpenAI invadiram bancos de dados operados pelo sistema nacional de saúde de seu país, um dos vários incidentes de segurança cibernética deste ano aparentemente causados por um programa de treinamento ou avaliação da OpenAI.
De acordo com a OpenAI, seus agentes publicaram imagens fornecidas por usuários na internet antes que a empresa implementasse uma série de novos procedimentos de segurança, embora permaneça incerto exatamente quando ou por que isso aconteceu. As novas salvaguardas foram instituídas depois que seus agentes invadiram o Hugging Face, uma plataforma para modelos de IA e benchmarks.
O vazamento dessas imagens foi revelado no momento em que a empresa enfrenta alegações de matemáticos de que os modelos da OpenAI copiaram o trabalho deles para resolver problemas de longa data na área, o que o laboratório nega. Questões sobre privacidade e segurança de dados também complicam os esforços para implantar ferramentas de IA em locais de trabalho ou para vender assistentes baseados em LLM para consumidores.
A OpenAI enfatizou que seus usuários corporativos são excluídos automaticamente de ter suas interações usadas para treinar futuros modelos; no entanto, os usuários consumidores são incluídos automaticamente, a menos que escolham ativamente não compartilhar seus dados. Mesmo assim, clicar no botão de polegar para cima ou polegar para baixo em uma conversa ainda tornará essa interação disponível para treinar futuros modelos.
Esta matéria foi atualizada para incluir a declaração da OpenAI de que é incapaz de identificar os usuários que forneceram as imagens que foram publicadas publicamente.