Agentes da OpenAI divulgaram 53 imagens provenientes de conversas de utilizadores do ChatGPT, num novo incidente identificado durante a investigação da empresa aos comportamentos não autorizados dos seus sistemas de inteligência artificial.

A OpenAI não esclareceu se as imagens mostravam pessoas reais ou tinham sido geradas por IA, nem revelou quando foram publicadas. A maioria dos ficheiros já foi removida e a empresa afirma que contactou os serviços responsáveis pelo alojamento dos restantes conteúdos.
Segundo a Reuters, o caso surgiu durante a revisão dos registos internos da OpenAI, que procura determinar a dimensão das ações executadas pelos agentes fora dos limites definidos.
Imagens vieram de conteúdos fornecidos ao ChatGPT
As imagens estavam incluídas em dados a que os agentes tiveram acesso durante os processos internos da OpenAI. A empresa reconheceu que os ficheiros tinham origem em conversas de utilizadores do ChatGPT.
A OpenAI explica que pode utilizar conteúdos fornecidos através dos seus serviços para indivíduos no treino e melhoria dos modelos. Os utilizadores podem impedir que novas conversas sejam usadas para esse fim através dos controlos de dados disponíveis no ChatGPT.
Os produtos empresariais seguem regras diferentes e, por predefinição, os respetivos conteúdos não são utilizados para treinar os modelos.
A questão torna-se mais relevante no caso das imagens. A OpenAI afirma que aplica mecanismos destinados a reduzir informação pessoal antes do treino dos modelos e descreve um sistema denominado Privacy Filter, que identifica e mascara dados pessoais presentes em texto. A documentação pública não indica que esse filtro remova elementos identificativos existentes no próprio conteúdo visual.
Uma fotografia pode revelar um rosto, uma matrícula, uma morada, documentos ou outros elementos capazes de identificar direta ou indiretamente uma pessoa. A remoção de nomes, texto associado ou metadados não elimina necessariamente essa informação visual.
Investigação já identificou dezenas de incidentes
Em meados de setembro, a OpenAI tinha identificado cerca de duas dezenas de episódios considerados problemáticos, segundo a Reuters. A investigação continuou a revelar novos casos à medida que a empresa analisou os registos produzidos pelos agentes.
A OpenAI prevê que esta revisão possa prolongar-se durante vários meses e afirma ter notificado dezenas de entidades externas afetadas ou potencialmente envolvidas.
Os modelos também consultaram informação disponível nos sistemas da Securities and Exchange Commission e dados do Census Bureau através de serviços do Departamento do Comércio dos Estados Unidos. A OpenAI afirma não ter encontrado indícios de acesso não autorizado ou de contas comprometidas nesses casos.
Investigadores da Transluce identificaram ainda uma tentativa sem sucesso contra um portal do Departamento de Educação norte-americano.
Os episódios fazem parte de uma investigação mais ampla iniciada depois de agentes da OpenAI terem ultrapassado as restrições impostas durante testes e acedido a sistemas da Hugging Face. Nesse caso, os sistemas conseguiram contornar mecanismos destinados a isolá-los da Internet e executaram ações em infraestruturas externas.
O incidente das 53 imagens introduz, contudo, um risco diferente. Em vez de se limitar ao acesso a sistemas externos, mostra que dados fornecidos por utilizadores podem voltar a circular quando um agente dispõe de capacidade para publicar ficheiros ou interagir com serviços na Internet.
A OpenAI ainda não revelou que tipo de imagens foi divulgado, onde foram publicadas, durante quanto tempo permaneceram acessíveis ou se alguma delas permitia identificar os respetivos utilizadores.
Outros artigos interessantes:


